arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-08-25 至 2026-08-25 共收录 112 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医疗多模态 8 篇

2409.16183 2026-08-25 cs.CV 版本更新 85%

Expert-level vision-language foundation model for real-world radiology and comprehensive evaluation

面向真实世界放射学的专家级视觉-语言基础模型及综合评估

Xiaohong Liu, Guoxing Yang, Yulin Luo, Jiaji Mao, Xiang Zhang, Haibo Wang, Zhiyang He, Ming Gao, Shanghang Zhang, Jun Shen, Guangyu Wang

专题命中 医疗多模态 :radiology(title,abstract);CT(abstract,abstract_cn);分类 cs.CV

AI总结 本研究提出面向放射学的开源VL基础模型RadFound,通过增强视觉编码器与跨模态学习设计,在自主构建的真实世界基准RadVLBench上显著优于其他VL模型,具备专家级放射学多模态处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21810 2026-08-25 cs.LG cs.CV 新提交 81%

MSM-Mem: A Universal Medical Structured Multimodal Memory Framework for Medical AI Agents

MSM-Mem:面向医疗AI智能体的通用医疗结构化多模态记忆框架

Md Asaduzzaman Jabin, Khoa Le, Lin Zhao, Tianming Liu

机构 * University of Georgia(佐治亚大学) New Jersey Institute of Technology(新泽西理工学院)

专题命中 医疗多模态 :medical AI(title,abstract);分类 cs.CV、cs.LG

AI总结 针对现有医疗AI智能体无法内化临床经验的问题,提出MSM-Mem框架,整合多类型临床经验并逐步更新,经MoE-LLaVA评估可提升性能,助力医疗AI智能体随实践进化推理能力。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22217 2026-08-25 cs.CV 新提交 79%

UR$^{2}$-MLLM: Uncertainty-aware Revisit Reasoning in Multimodal Large Language Models for Radiology Report Generation

UR²-MLLM:面向放射科报告生成的多模态大语言模型中基于不确定性感知的重访推理

Yucheng Chen, Yang Yu, Jiazhou Zhou, Yufei Shi, Yongying Lan, Yichi Zhang, Liyi Li, Si Yong Yeo

机构 * MedVisAI Lab(MedVisAI实验室) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李光前医学院) Centre of AI in Medicine, Singapore(新加坡医学人工智能中心) AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)AI方向) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院)

专题命中 医疗多模态 :radiology(title,abstract);分类 cs.CV

AI总结 该研究针对放射科报告生成任务,提出UR²-MLLM框架,通过动态重访不确定区域的机制实现最优性能,提升报告的可靠性与临床适配性。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23143 2026-08-25 cs.CV 新提交 74%

An end-to-end-trained vision-language model for native-language prostate pathology report generation

用于生成本土语言前列腺病理报告的端到端训练视觉-语言模型

Christian Grashei, Fabian Gülhan, Maximilian Legnar, Fabian Stögbauer, Cleo-Aron Weis, Carolin Mogler, Peter Schüffler

机构 * Technical University of Munich(慕尼黑工业大学) Munich Data Science Institute(慕尼黑数据科学研究所) Munich Center for Machine Learning(慕尼黑机器学习中心) University Hospital Heidelberg(海德堡大学医院) Heidelberg University(海德堡大学) Interdisciplinary Center for Scientific Computing (IWR)(跨学科科学计算中心(IWR))

专题命中 医疗多模态 :pathology(title);分类 cs.CV

AI总结 该研究提出语言独立的切片级视觉-语言框架,用自动化流水线生成17344对图像-文本对,实现德语前列腺病理报告生成,恶性肿瘤检测F1达96.2%,可支持机构用自有档案训练本土语言报告模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22323 2026-08-25 cs.CV 新提交 57%

MedReaMM: Evaluating Large Multimodal Models on Expert-Level Clinical Diagnostic Synthesis

MedReaMM:评估大型多模态模型在专家级临床诊断综合能力上的表现

Lai Wei, Yuchao Chen, Zhenbiao Cao, Xiaojin Zhang, Zhongyu Wei, Bangting Wang, Wei Chen, Xiang Bai

机构 * The First Affiliated Hospital with Nanjing Medical University(南京医科大学第一附属医院) Jiangsu Province Hospital(江苏省医院) Huazhong University of Science Technology(华中科技大学) Fudan University(复旦大学)

专题命中 医疗多模态 :medical image(abstract);分类 cs.CV

AI总结 本研究构建了多模态临床诊断基准MedReaMM,评估23个大型多模态模型的诊断综合能力,发现多数模型准确率不足50%,揭示了该领域的能力差距及相关影响因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22174 2026-08-25 cs.CV 新提交 57%

When Does Visual Generation Help Visual Understanding in Unified Multimodal Models?

统一多模态模型中视觉生成何时能助力视觉理解?

Yubo Zhu, Zhehan Kan, Jingyi Yang, Miaolin Chen, Jinbo Xing, Kai Zhu, Zijian Wang, Sheng Zhong, Wei Tong

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Fudan University(复旦大学)

专题命中 医疗多模态 :diagnosis(abstract);分类 cs.CV

AI总结 本研究提出VGAU-Diag评估框架,发现统一多模态模型的视觉生成仅在简单任务上助益理解,瓶颈多在理解侧,有效生成需瞄准理解瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08724 2026-08-25 cs.CV 版本更新 57%

SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment

SynerMedGen:通过任务对齐协同医疗多模态理解与生成

Weiren Zhao, Yi Dong, Cheng Chen

机构 * The University of Hong Kong, Hong Kong, China(香港大学)

专题命中 医疗多模态 :medical image(abstract);分类 cs.CV

AI总结 SynerMedGen通过任务对齐实现医疗多模态理解与生成的协同,提出生成对齐理解任务和两阶段训练策略,实现零样本性能和跨数据集泛化,释放大规模数据集支持进一步研究。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22363 2026-08-25 cs.AI 新提交 50%

Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA

分析与缓解多模态医学视觉问答中的跨语言退化问题

Jingbo Wang, Sendong Zhao, Haochun Wang, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 医疗多模态 :clinical AI(abstract)

AI总结 针对多模态医学VQA中LVLMs的跨语言退化问题,构建多语言基准并提出MedVL-XLRepE方法,可在3种LVLMs和8种语言上将退化缓解幅度提升至最高6.33%。

Comments EMNLP 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 生物医学文本 8 篇

2608.21864 2026-08-25 cs.LG cs.AI cs.CV 新提交 81%

BioMed-Agent-RL: A Meta Learning, All You Need for Biomedical Applications

BioMed-Agent-RL:元学习,生物医学应用的一切所需

Md Asaduzzaman Jabin, Zihao Wu, Tianming Liu

专题命中 生物医学文本 :biomedical(title,abstract);分类 cs.CV、cs.LG

AI总结 该研究针对临床视觉大语言模型的缺陷,提出BioMed-Agent-RL医学智能体,整合多模态元学习与强化学习等技术,在多基准实验中准确率达约73%,较现有模型提升约5%,为临床智能体系统建立新标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23214 2026-08-25 cs.CL cs.IR 新提交 78%

Aligning Biomedical Texts and Knowledge Graphs: A Systematic Comparison of Lightweight Alignment Strategies

生物医学文本与知识图谱的对齐:轻量对齐策略的系统比较

Artem Bisliouk, Elizaveta Nosova, Heiko Paulheim, Andreea Iana, Rita T. Sousa

机构 * University of Mannheim(曼海姆大学)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 本研究提出统一框架系统比较生物医学文本与KG的轻量对齐策略,构建CTD-Align语料库,发现三元组组合和训练方向影响最大,线性投影效果最优,为二者桥接提供实用基础。

Comments Accepted at the Third Workshop on Knowledge Graphs and Neurosymbolic AI (KG-NeSy 2026) co-located with ISWC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22132 2026-08-25 cs.CL cs.AI cs.CE 新提交 78%

SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning

SSE-Bio:面向多跳生物医学推理的、具备智能体式检索策略的结构化自进化智能体

Zhaohan Meng, Zaiqiao Meng, Siwei Liu, Hao Xu, Ke Yuan, Iadh Ounis

机构 * School of Computing Science, University of Glasgow(格拉斯哥大学计算科学学院) Brigham and Women’s Hospital, Harvard Medical School, Harvard University(哈佛大学医学院附属布莱根妇女医院) Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) School of Natural and Computing Science, University of Aberdeen(阿伯丁大学自然与计算科学学院) School of Cancer Sciences, University of Glasgow(格拉斯哥大学癌症科学学院) Cancer Research UK Scotland Institute(英国癌症研究苏格兰研究所)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 本研究针对生物医学多跳问答的指令漂移问题,提出SSE-Bio结构化自进化智能体,通过代理策略选择性检索、细粒度模板编辑及组相对策略优化,在三个基准上实现优于现有基线的性能,BioHopR上提升6.56绝对点。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03854 2026-08-25 cs.LG 版本更新 74%

When Calibration Depends on the Scoring Rule: Quantized Biomedical LLM Classification

量化对生物医学大语言模型可靠性的影响

Anton Rasmussen, Hong Qin

专题命中 生物医学文本 :biomedical(title);分类 cs.LG

AI总结 该研究针对 Mistral-7B 变体在 PubMed RCT 句子分类任务上,评估量化及提示模板、评分规则等对生物医学大语言模型可靠性的影响,发现这些因素对校准和准确率的影响不可忽视。

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19616 2026-08-25 cs.LG cs.SI 版本更新 65%

DuoGNN: Topology-aware Graph Neural Network with Homophily and Heterophily Interaction-Decoupling

DuoGNN:具备同质性与异质性交互解耦的拓扑感知图神经网络

K. Mancini, I. Rekik

专题命中 生物医学文本 :diagnosis(abstract);分类 cs.LG;medical image(journal_ref);biomedical(journal_ref)

AI总结 针对GNN过平滑、过压缩及泛化差的问题,提出拓扑感知的DuoGNN,通过解耦同/异质性边的双聚合流水线实现提升,在多类节点分类任务中表现优于变体。

Journal ref Mancini, K., Rekik, I. (2025). DuoGNN: Topology-Aware Graph Neural Network with Homophily and Heterophily Interaction-Decoupling. Graphs in Biomedical Image Analysis. GRAIL 2024, vol 15182. Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21913 2026-08-25 cs.CV 新提交 57%

Entity-Constrained CBCT Retrieval for Low-Resource Dental Record Completion

用于低资源牙科记录补全的实体约束锥形束计算机断层扫描(CBCT)检索

Nhi Ngoc-Yen Nguyen, Thai Nguyen, Kiet Huynh Cao Tuan, Huy-Hieu Pham

机构 * VinUniversity Vietnam National University Ho Chi Minh City(胡志明市国家大学) University of Science(科学大学)

专题命中 生物医学文本 :diagnosis(abstract);分类 cs.CV

AI总结 针对低资源牙科记录补全难题,提出实体约束CBCT引导检索框架,其在MMDental任务3验证集与测试集上均优于基线方法,获测试阶段第二名,证实控制多模态证据修改范围比传输完整记录更可靠。

Comments Accepted at the ODIN 2026 Workshop, MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23047 2026-08-25 cs.CL cs.AI 新提交 50%

Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking

超越裁决:科学事实核查中人类与大语言模型推理的基于图的分析

Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou

机构 * Interdisciplinary Transformation University Austria (ITU)(奥地利跨学科转型大学(ITU))

专题命中 生物医学文本 :biomedical(abstract)

AI总结 本研究提出类型化推理图框架,用于对比科学事实核查中人类与LLM的推理路径,基于MISSCIPLUS数据集评估GPT-5等模型,发现各模型在裁决性能与人类对齐度上存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23487 2026-08-25 cond-mat.soft physics.flu-dyn 新提交 50%

Reaching the thermodynamic limit of wicking on textured surfaces

在结构化表面上达到毛细上升的热力学极限

Zhaoyang Lv, Chen Ma, Li-Chen Huang, Yanshen Li

专题命中 生物医学文本 :biomedical(abstract)

AI总结 该研究通过调整微柱形状与排列规避能垒,实现了结构化表面上弱亲水性液体的毛细上升,达到热力学极限,获82度接触角,其毛细上升系数优于同孔隙率矩形沟槽,可推进生物医学与热管理技术。

Comments This work is under review at a peer-reviewed journal. Correspondence should be addressed to liyanshen@ucas.ac.cn

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 健康监测 1 篇

2608.23347 2026-08-25 cs.LG 新提交 57%

Test-Time Adaptation for ECG Classification via SQI-Gated Self-Training and Beat-Rhythm Consistency

基于SQI门控自训练与节拍-节律一致性的心电图分类测试时适应

Wenhan Jiang, Zhipeng Deng, Jiale Zhou, Haolin Wang, Yafei Ou, Yefeng Zheng

机构 * Westlake University(西湖大学) Hokkaido University(北海道大学) RIKEN(理化学研究所)

专题命中 健康监测 :diagnosis(abstract);分类 cs.LG

AI总结 针对现有测试时适应(TTA)方法在ECG分类任务中忽略节拍-节律结构、易受伪影影响的问题,提出BeatRhythm-TTA框架,通过SQI门控方案与双层次一致性提升性能,在多域ECG诊断中获2.70%的Macro-F1相对提升。

Comments Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 医学数据与评测 5 篇

2608.21813 2026-08-25 cs.CV 新提交 70%

Through the Schrödinger Bridge: Benchmarking Antemortem Image Restoration from Postmortem Autolysis to Enhance Forensic Diagnostics

通过薛定谔桥:法医死后自溶前图像修复的基准测试以增强法医诊断

Shuang Hao, Jiacheng Yue, Yaxuan Zhao, Fan Wang, Jianhua Ma, Erwen Huang, Chunfeng Lian

机构 * Xi’an Jiaotong University(西安交通大学) Sun Yat-Sen University(中山大学)

专题命中 医学数据与评测 :pathology(abstract);diagnosis(abstract);分类 cs.CV

AI总结 本研究针对法医组织病理学中死后自溶导致的图像修复难题,构建首个同源无配对数据集AutoPath,提出基于薛定谔桥的方法,建立法医自溶修复的可复现基准及评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22188 2026-08-25 cs.LG cs.CL cs.DC 新提交 57%

Unveiling the Depth-Performance Dilemma in Split-Federated Fine-tuning of LLMs

揭示大语言模型的拆分式联邦微调中的深度-性能困境

Hariharan Ramesh, Someshwaran Murugaiyan, Jyotikrishna Dass

机构 * Vellore Institute of Technology(韦洛尔理工学院) University of Arizona(亚利桑那大学)

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.LG

AI总结 本研究针对拆分式联邦微调(SFF),识别出深度-性能困境,评估多种联邦适配器聚合方法后发现其无法缓解拆分架构缺陷,归因于Transformer拓扑,为分布式LLM微调提供结构基础。

Comments 24 pages, 10 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21626 2026-08-25 cs.LG 新提交 57%

Rethinking Communication Metrics: How Should We Measure Meaning?

重新思考通信指标:我们应如何衡量意义?

Niloofar Tavakolian, Hakimeh Purmehdi, Jungyeon Baek

机构 * Ericsson Canada(爱立信加拿大公司) Concordia University(康考迪亚大学)

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.LG

AI总结 本文针对语义通信评估碎片化问题,从评估视角综述文本与图像语义通信的关键性能指标,分类梳理各类指标,分析现存挑战并展望未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21833 2026-08-25 cs.AI cs.CL 新提交 50%

GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?

GameXpert-Bench:编码智能体距离专家级游戏开发还有多远?

Kun Chen, Haorong Hong, Peizhong Gao, Jianfeng Lin, Tongxu Luo, Yuxuan Xie, Chenxu Liu, Jieling He, Zhongyuan Liu, Zeno Zeng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Lightspeed Studios, Tencent(腾讯光速工作室)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 GameXpert-Bench是覆盖游戏开发全生命周期的基准,含三个赛道,测评显示当前编码智能体在生成可玩游戏基础上表现较好,在缺陷发现等方面仍有不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09590 2026-08-25 cs.CL cs.CR 版本更新 50%

Clinically Grounded Privacy Evaluation of Medical LMs

临床导向的医学语言模型隐私评估

Sasha Ronaghi, Sana Tonekaboni, Lena Stempfle, Vivian Utti, Jordan Li Cahoon, Nathaniel Hendrix, Ayin Vala, Marzyeh Ghassemi, Emily Alsentzer

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) American Board of Family Medicine(家庭医学认证委员会)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 提出临床导向框架,按对抗访问等级评估医学语言模型隐私泄露,发现常规元数据可导致高比率逐字记忆和敏感诊断恢复,但部分记忆源于模板化文档。

详情

展开后加载摘要…

URL PDF HTML 收藏