arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2025-12-30 至 2025-12-30 共收录 11
2512.23545 2025-12-30 cs.CV cs.AI

PathFound: An Agentic Multimodal Model Activating Evidence-seeking Pathological Diagnosis

PathFound: 一种促进证据寻求病理诊断的代理多模态模型

Shengyi Hua, Jianfeng Wu, Tianle Shen, Kangzhe Hu, Zhongzhen Huang, Shujuan Ni, Zhihong Zhang, Yuan Li, Zhe Wang, Xiaofan Zhang

机构 * Qing Yuan Research Institute, Shanghai Jiao Tong University(上海交通大学庆元研究院) Shanghai Innovation Institute(上海创新研究院) Department of Pathology, The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学生命科学与医学学院病理科) Intelligent Pathology Institute, Division of Life Sciences and Medicine(生命科学与医学学院智能病理研究所) Department of Pathology, Fudan University Shanghai Cancer Center(复旦大学上海癌症中心病理科) Department of Oncology, Shanghai Medical College, Fudan University(复旦大学上海医学院肿瘤科) Institute of Pathology, Fudan University(复旦大学病理研究所) Department of Pathology, The First Affiliated Hospital with Nanjing Medical University(南京医科大学第一附属医院病理科)

AI总结 PathFound是一种通过主动信息获取和诊断完善来提升病理诊断准确性的代理多模态模型,其在多种临床场景中表现出卓越的诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23343 2025-12-30 cs.CL cs.AI cs.CV

AI Meets Brain: Memory Systems from Cognitive Neuroscience to Autonomous Agents

AI 与大脑:从认知神经科学到自主代理的记忆系统

Jiafeng Liang, Hao Li, Chang Li, Jiaqi Zhou, Shixin Jiang, Zekun Wang, Changkai Ji, Zhihao Zhu, Runxuan Liu, Tao Ren, Jinlan Fu, See-Kiong Ng, Xia Liang, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Fudan University(复旦大学) Peking University(北京大学) National University of Singapore(新加坡国立大学)

AI总结 本文从认知神经科学到自主代理,系统综合了记忆的跨学科知识,探讨了记忆的定义、功能、分类、存储机制及安全问题,并展望了多模态记忆系统和技能获取的未来研究方向。

Comments 57 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23333 2025-12-30 cs.CV

CME-CAD: Heterogeneous Collaborative Multi-Expert Reinforcement Learning for CAD Code Generation

CME-CAD:异构协作多专家强化学习用于CAD代码生成

Ke Niu, Haiyang Yu, Zhuofan Chen, Zhengtao Yao, Weitao Jia, Xiaodong Ge, Jingqun Tang, Benlei Cui, Bin Li, Xiangyang Xue

机构 * Fudan University(复旦大学) ByteDance Inc(字节跳动公司)

AI总结 CME-CAD通过异构协作多专家强化学习方法,提升CAD代码生成的精度和可编辑性,提出两阶段训练流程并构建开源基准CADExpert。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23244 2025-12-30 cs.CV cs.AI

ViLaCD-R1: A Vision-Language Framework for Semantic Change Detection in Remote Sensing

ViLaCD-R1: 一种用于遥感语义变化检测的视觉-语言框架

Xingwei Ma, Shiyang Feng, Bo Zhang, Bin Wang

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 ViLaCD-R1通过多图像推理器和掩码引导解码器,提升遥感变化检测的语义识别与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17703 2025-12-30 cond-mat.str-el cond-mat.mtrl-sci cs.LG physics.comp-ph

Revisiting the Broken Symmetry Phase of Solid Hydrogen: A Neural Network Variational Monte Carlo Study

重新审视固态氢的破缺对称相:一种神经网络变分蒙特卡洛研究

Shengdu Chai, Chen Lin, Xinyang Dong, Yuqiang Li, Wanli Ouyang, Lei Wang, X. C. Xie

机构 * Interdisciplinary Center for Theoretical Physics(理论物理交叉中心) Information Sciences (ICTPIS), Fudan University(信息科学(ICTPIS),复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Engineering, University of Oxford(工程系,牛津大学) Beijing National Laboratory for Condensed Matter Physics(北京凝聚态物理实验室) Institute of Physics, Chinese Academy of Sciences(物理研究所,中国科学院) Department of Information Engineering, The Chinese University of Hong Kong(信息工程系,香港中文大学) International Center for Quantum Materials, School of Physics, Peking University(国际量子材料中心,物理系,北京大学) Hefei National Laboratory(合肥国家实验室)

AI总结 本文通过神经网络变分蒙特卡洛方法研究固态氢的破缺对称相,发现其基态结构候选者Cmcm空间群对称性,并验证其稳定性及与实验数据的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20666 2025-12-30 cs.LG cs.AI

Continuous-Time Attention: PDE-Guided Mechanisms for Long-Sequence Transformers

连续时间注意力:用于长序列Transformer的PDE引导机制

Yukun Zhang, Xueqing Zhou

机构 * The Chinese University Of Hongkong(香港中文大学) Fudan University(复旦大学)

AI总结 本文提出连续时间注意力机制,通过引入偏微分方程提升长序列Transformer对长距离依赖性和梯度流动的处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14404 2025-12-30 cs.CV

ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations

ViC-Bench: 用自由式中间状态表示法对多模态大语言模型的视觉交错链式思维能力进行基准测试

Xuecheng Wu, Jiaxing Liu, Danlei Huang, Yifan Wang, Yunyun Shi, Kedi Chen, Junxiao Xue, Yang Liu, Chunlin Chen, Hairong Dong, Dingkang Yang

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Meituan Inc.(美团公司) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

AI总结 ViC-Bench 通过自由式中间状态表示法,系统评估多模态大语言模型的视觉交错链式思维能力,涵盖四个任务并提出新评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17951 2025-12-30 cs.CV cs.AI

Robust Polyp Detection and Diagnosis through Compositional Prompt-Guided Diffusion Models

通过组成提示引导的扩散模型实现鲁棒的息肉检测与诊断

Jia Yu, Yan Zhu, Peiyao Fu, Tianyi Chen, Junbo Huang, Quanlin Li, Pinghong Zhou, Zhihua Wang, Fei Wu, Shuo Wang, Xian Yang

机构 * Zhejiang University(浙江大学) Shanghai Institute for Advanced Study of Zhejiang University(浙江大学上海高等研究院) Endoscopy Center, Zhongshan Hospital, Fudan University(复旦大学中山医院内窥镜中心) Shanghai Collaborative Innovation Center of Endoscopy(上海内窥镜协同创新中心) Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医疗研究中心) Shanghai Key Laboratory of MICCAI(上海MICCAI重点实验室) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟商学院) Data Science Institute, Imperial College London(伦敦帝国学院数据科学研究所)

AI总结 本文提出PSDM模型,通过整合多种临床注释生成合成图像,提升息肉检测、分类和分割的鲁棒性和泛化能力。

Journal ref IEEE Trans. Med. Imaging, vol. 44, no. 12, pp. 5245-5257, Dec. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19466 2025-12-30 cs.CV cs.LG

ForgerySleuth: Empowering Multimodal Large Language Models for Image Manipulation Detection

ForgerySleuth: 赋能多模态大语言模型进行图像篡改检测

Zhihao Sun, Haoran Jiang, Haoran Chen, Yixin Cao, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang

机构 * Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(上海智能信息处理关键实验室,复旦大学计算机学院) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心)

AI总结 ForgerySleuth通过多模态大语言模型进行图像篡改检测,利用线索融合和数据集构建提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12004 2025-12-30 eess.IV cs.LG eess.SP

NLCG-Net: A Model-Based Zero-Shot Learning Framework for Undersampled Quantitative MRI Reconstruction

NLCG-Net:一种用于欠采样定量磁共振成像重建的基于模型的零样本学习框架

Xinrui Jiang, Yohan Jun, Jaejin Cho, Mengze Gao, Xingwang Yong, Berkin Bilgic

机构 * Fudan University(复旦大学) Harvard Medical School(哈佛医学院) Massachusetts General Hospital(麻省总医院) Stanford University(斯坦福大学) Zhejiang University(浙江大学)

AI总结 NLCG-Net通过结合U-Net正则化器和单指数信号建模,实现了基于模型的零样本学习,用于高加速因子下的T2/T1定量磁共振成像重建。

Comments 5 pages, 5 figures, accepted by International Society for Magnetic Resonance in Medicine 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07328 2025-12-30 cs.CV

Enhance Multi-Scale Spatial-Temporal Coherence for Configurable Video Anomaly Detection

增强可配置视频异常检测的多尺度空间-时间一致性

Kai Cheng, Xinzhe Li, Lijuan Che

机构 * Fudan University(复旦大学) East China University of Science and Technology(东华大学) School of Artificial Intelligence in Traditional Chinese Medicine(中医人工智能学院) Shanghai University of Traditional Chinese Medicine(上海中医药大学)

AI总结 本研究提出一种可配置的视频异常检测方法,通过多尺度空间-时间一致性模块提升检测准确性和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏