arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-08-26 至 2026-08-26 共收录 5 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 5 篇

2608.24486 2026-08-26 eess.IV cs.CV 新提交 73%

Model Effect or Label Effect? Refined Annotations and a Human-Referenced Benchmark for Pulmonary Embolism Segmentation

模型效应还是标注效应?用于肺栓塞分割的优化标注及人类参照基准

Qihang Sun, Zhongxiao Liu, Bailiang Jian, Shenman Qiu, Jingyuan Wang, Lei Zhang, Lixiang Xie, Jiazhen Pan, Christian Wachinger

专题命中 医学数据与评测 :CT(abstract,abstract_cn);分类 cs.CV、eess.IV

AI总结 该研究量化了肺栓塞分割中评估标注与模型训练对性能的影响,发现标注效应至少与模型效应相当,建立了人类参照的nnPE基准模型及公开框架。

Comments 32 pages, 9 figures, 8 tables. Supplementary material (S1-S9) included as an appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00260 2026-08-26 cs.CV 版本更新 70%

C3VDReg: A Benchmark for Local-to-Local Colonoscopic Registration toward Anatomical Localization

C3VDReg:面向解剖定位的局部-局部结肠镜配准基准

Linzhe Jiang, Jiayuan Huang, Sophia Bano, Matthew J. Clarkson, Zhehua Mao, Mobarak I. Hoque

机构 * UCL Hawkes Institute(UCL哈维斯研究所) University College London, University of London(伦敦大学学院, 伦敦大学) Division of Informatics, Imaging and Data Sciences(信息学、成像与数据科学部门) University of Manchester(曼彻斯特大学)

专题命中 医学数据与评测 :CT(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出面向局部-局部结肠镜配准的基准C3VDReg,通过构建点云对评估基线模型,发现高几何重叠不足以保证配准精度,重复管状解剖的平移歧义是主要瓶颈,凸显需更强解剖与上下文约束。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23839 2026-08-26 cs.RO cs.AI 新提交 50%

Resilience Matters for Embodied Agents System: New Metrics, Systematic Evaluation, and Optimization

弹性对具身智能体系统的重要性:新指标、系统评估与优化

Yapeng Liu, Yuanzhao Zhai, Xudong Gong, Dawei Feng, Bo Ding, Lin Wang, Huaimin Wang

机构 * National University of Defense Technology(国防科技大学) Nanyang Technological University(南洋理工大学)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 该研究针对具身智能体系统忽略弹性属性的问题,提出弹性评估框架与指标集,经400项家庭任务实验验证其诊断优化效果,揭示弹性特征间的权衡关系。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14265 2026-08-26 cs.CL cs.MA 版本更新 50%

MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-Ended Question Answering

MedPriv-Bench:医疗开放问答中大语言模型隐私-效用权衡的基准测试

Shaowei Guan, Yu Zhai, Hin Chi Kwok, Jiawei Du, Xinyu Feng, Jing Li, Harry Qin, Vivian Hui

专题命中 医学数据与评测 :medical AI(abstract)

AI总结 MedPriv-Bench首次提出医疗开放问答中评估隐私保护与临床效用的基准,通过多代理人机协同流程生成敏感医疗情境,利用预训练RoBERTa-NLI模型量化数据泄露,揭示大语言模型在隐私与效用间的普遍权衡。

Comments Accepted to EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00468 2026-08-26 cs.SE 版本更新 50%

Cloud-OpsBench: A Reproducible Benchmark for Agentic Root Cause Analysis in Cloud Systems

Cloud-OpsBench: 一种可重现的云系统代理根本原因分析基准

Yilun Wang, Guangba Yu, Haiyu Huang, Yujie Huang, Zirui Wang, Pengfei Chen, Michael R. Lyu

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 Cloud-OpsBench 是一个用于云系统代理根本原因分析的可重现基准,通过构建确定性数字孪生,提供数据引擎、强化学习环境和诊断标准,支持下一代SRE研究。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏