arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2025-10-14 至 2025-10-14 共收录 5 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医疗多模态 5 篇

2510.10052 2025-10-14 cs.CV cs.AI 77%

Think Twice to See More: Iterative Visual Reasoning in Medical VLMs

Kaitao Chen, Shaohao Rui, Yankai Jiang, Jiamin Wu, Qihao Zheng, Chunfeng Song, Xiaosong Wang, Mu Zhou, Mianxin Liu

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Rutgers University(罗格斯大学)

专题命中 医疗多模态 :medical AI(abstract);medical image(abstract);diagnosis(abstract);分类 cs.CV

Comments 25 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11666 2025-10-14 eess.SP cs.LG 62%

Explainable Deep Neural Network for Multimodal ECG Signals: Intermediate vs Late Fusion

Timothy Oladunni, Ehimen Aneni

专题命中 医疗多模态 :medical AI(abstract);分类 cs.LG、eess.SP

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11112 2025-10-14 cs.CV 57%

Multimodal Disease Progression Modeling via Spatiotemporal Disentanglement and Multiscale Alignment

Chen Liu, Wenfang Yao, Kejing Yin, William K. Cheung, Jing Qin

机构 * School of Nursing, The Hong Kong Polytechnic University(香港理工大学护理学院) Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系)

专题命中 医疗多模态 :pathology(abstract);分类 cs.CV

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10464 2025-10-14 cs.CV 57%

Post-TIPS Prediction via Multimodal Interaction: A Multi-Center Dataset and Framework for Survival, Complication, and Portal Pressure Assessment

Junhao Dong, Dejia Liu, Ruiqi Ding, Zongxing Chen, Yingjie Huang, Zhu Meng, Jianbo Zhao, Zhicheng Zhao, Fei Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Division of Vascular and Interventional Radiology, Department of General Surgery, Nanfang Hospital, Southern Medical University(南方医科大学普外科血管介入放射科) Beijing Key Laboratory of Network System and Network Culture(北京网络系统与网络文化重点实验室)

专题命中 医疗多模态 :CT(abstract);分类 cs.CV

Comments 81 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10011 2025-10-14 cs.CV 57%

MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output

Yanyuan Chen, Dexuan Xu, Yu Huang, Songkun Zhan, Hanpin Wang, Dongxue Chen, Xueping Wang, Meikang Qiu, Hang Li

机构 * School of Software & Microelectronics, Peking University(软件与微电子学院,北京大学) School of Computer Science, Peking University(计算机学院,北京大学) National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) Peking University Sixth Hospital(北京大学第六医院) Augusta University(奥古斯塔大学) Peking University First Hospital(北京大学第一医院)

专题命中 医疗多模态 :medical image(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏