arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 8277 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 8277 篇

2608.00371 2026-08-04 cs.CV 新提交 57%

Decoding Children's Gait Behavior

儿童步态行为解码

Yifan Shen, Boyi Li, Meihuan Huang, Yuanzhe Liu, Xu Cao, Jinyang Jin, Zhengyuan Li, Anglin Liu, Junho Kim, Jingyuan Zhu, Lan Fangzhou, Jianguo Cao, Jintai Chen, Ismini Lourentzou, James Matthew Rehg

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) PediaMed AI Shenzhen Children’s Hospital(深圳市儿童医院) Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 针对儿童步态分析的临床需求,本文构建含110名受试者的1100余条高帧率视频数据集,指出现有先进模型难以解析其临床细节,提出统一端到端框架并建立自动化儿童步态评估基线。

Journal ref ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00356 2026-08-04 cs.CV 新提交 57%

The 1st AI Children Challenge

第一届AI儿童挑战赛

Boyi Li, Yifan Shen, Houze Yang, Xu Cao, Guojun Yun, Li Gao, Turong Chen, Long Xu, Jianguo Cao, Meihuan Huang

机构 * PediaMed AI University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) The Hong Kong Polytechnic University(香港理工大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 该第一届AI儿童挑战赛推出儿童步态视觉分析赛道,设EVGS评分、脑瘫步态模式分类任务,提供对应数据集与真值以推动AI在儿童医疗领域的应用。

Journal ref In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp. 5564-5570. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29621 2026-08-03 cs.LG cs.AI 新提交 57%

CENDRe: Concept Extraction with Natural Domain Representations

CENDRe:基于自然域表示的概念提取

Antonia Holzapfel, Andres Felipe Posada Moreno, Sebastian Trimpe

机构 * Institute for Data Science in Mechanical Engineering (DSME)(机械工程数据科学研究所(DSME)) RWTH Aachen University(亚琛工业大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 针对现有时间序列概念提取方法的局限,提出CENDRe方法,可自动确定概念数量,同时在时域和频域定位概念,在合成基准和真实轴承故障数据上均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29222 2026-08-03 cs.CV 新提交 57%

Is It Time for the Renaissance of Salient Object Detection in the Era of MLLMs?

多模态大语言模型(MLLMs)时代,显著性目标检测的复兴时机已到?

Wenzhuo Zhao, Xiuzhi Li, Zhongkuan Mao, Ronghao Xian, Yao Jiang, Zhao Gao, Keren Fu, Qijun Zhao, Jian Cheng

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 该研究针对MLLMs时代SOD的能力不匹配问题,提出无训练框架FOCUS,在13类SOD基准上超越SOTA方法,推动SOD从特定任务监督转向零样本前景组织。

Comments 10 pages, 4 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28993 2026-08-03 cs.RO cs.CV 新提交 57%

ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts

ST-WAM:面向视觉分布偏移下鲁棒操作的语义-时间世界动作模型

Mingxin Wang, Bin Hu, Bin Qian, Kaitao Jiang, Haoning Wu, Feng Yan, Bowen Jing, Ruiyang Hao, Enyi Wang, Kangning Niu, Yandan Yang, Mu Xu, Yan Wang, Houde Liu, Tianlun Li

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 该研究针对视觉分布偏移下机器人操作的鲁棒性问题,提出ST-WAM模型,采用DINOv3等技术,在多个基准测试中取得优异性能,大幅提升了偏移场景下的零样本操作表现。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05024 2026-08-03 cs.LG 57%

Concept Extraction for Time Series with ECLAD-ts

Antonia Holzapfel, Andres Felipe Posada-Moreno, Sebastian Trimpe

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27386 2026-07-31 cs.AI cs.LG 新提交 57%

Beyond the Bidirectional Promise: Re-evaluating the Robustness of Diffusion Language Models

超越双向承诺:重新评估扩散语言模型的鲁棒性

Saurabh Yadav, Badri Narayana Patro, Vijay Srinivas Agneeswaran

机构 * Microsoft(微软公司)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 该研究评估了扩散语言模型的鲁棒性,发现其虽能抵御部分对抗攻击但易受自然噪声影响,存在过度自信问题,脆弱性源于解码器路由故障,需将鲁棒性整合入迭代解码循环。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26647 2026-07-30 cs.CV 新提交 57%

Anchoring and Steering Diffusion: Enhancing the Faithfulness of Text-to-Image Generation at Inference Time

锚定与引导扩散:在推理时提升文生图生成的忠实度

Xinyi Wang, Yuyang Huang, Yalin Su, Pengcheng Luan, Tao Zhang, Feiming Wei, Wenxian Yu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 提出无训练框架AnchorSteer,通过语义锚定与反射引导组件改进文生图扩散模型的推理,在GenEval等基准上提升文本-图像对齐性能且保持视觉质量。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26582 2026-07-30 cs.CV 新提交 57%

Level, Sharpness, and Corpus: Why Zero-Shot OOD Detector Rankings Do Not Transfer

水平、锐度与语料:为何零样本分布外检测器的排名无法迁移

Ignacio M. De la Jara, Cristian Rodriguez-Opazo, Stephen Gould, Damith Ranasinghe

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 本文通过审计证明零样本OOD检测器排名无法跨域迁移,提出CEG封装器,可降低检测器敏感性并提升GL-MCM与MCM的族平衡FPR95。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25468 2026-07-30 cs.CV 版本更新 57%

Safety-Aware Cascaded Inference for Crop Damage Assessment with Controlled Error Trade-offs

具有可控误差权衡的作物损害评估安全感知级联推理

José Thiéry Messigbédé Hagbe, Gani Kawsar Gounou, Songbian Karim Zimé

机构 * African School of Economics(非洲经济学院)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 研究针对小农户作物损害评估中漏检成本高问题,提出CascadeCropNet级联架构,通过阈值选择满足召回约束,经实验验证该架构能有效减少漏检,在可靠性优先场景下可实现安全导向决策约束。

Comments 44 pages, 7 figures, 12 tables. Submitted to Computers and Electronics in Agriculture, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25324 2026-07-29 cs.CV cs.AI 新提交 57%

Balanced Soft mixture-of-expert model for Glaucoma Detection

用于青光眼检测的平衡软专家混合模型

Sai Venkatesh Chilukoti, Krishna Rauniyar, Min Shi, Xiali Hei

机构 * University of Louisiana at Lafayette(路易斯安那大学拉斐特分校) School of Computing and Informatics(计算与信息学院)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 针对青光眼检测,提出含三个专家及负载平衡损失的平衡软专家混合模型,解决多模态学习问题,其性能通过AUC衡量,超越多种基线和模型,还可推广至其他疾病检测。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25129 2026-07-29 cs.CL cs.LG 新提交 57%

Deep Label-Wise Attentive Temporal Convolutional Networks Improve Medical Coding

深度标签明智注意力时间卷积网络改进医学编码

Muhammed Yavuz Nuzumlalı, Alexander Fabbri, Irene Li, Dragomir Radev

机构 * Yale University(耶鲁大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究医学编码难题,提出由多层时间卷积网络和标签明智注意力组成的深度神经模型,相比之前模型,F-1分数显著提高,召回分数大幅增加,对临床决策支持有重要意义。

Comments Work carried out in 2019; posted as a record of the work. Baselines and state of the art reflect the 2019 literature

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24727 2026-07-28 cs.CV 新提交 57%

Infrared Imaging Empowered by Artificial Intelligence for Pediatric Skeletal Triage: A Narrative Review and Future Perspectives

人工智能助力的儿科骨骼分类红外成像:综述与未来展望

Sajad Amiri, Pardis Afshar, Elham Anjomshoa

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 该研究旨在构建结合广谱红外成像与深度学习的混合框架用于儿科骨骼分类。回顾相关光谱窗口及采集方式,总结图像转换和特征匹配算法。指出儿科解剖利于红外穿透,集成多光谱红外+人工智能成像是无辐射补充,但面临多方面障碍。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24353 2026-07-28 cs.CV 新提交 57%

PRISM: Prompt Refinement via Image-grounded Self-rewarding Mechanism for Text-to-Image Generation

PRISM:通过基于图像的自我奖励机制进行文本到图像生成的提示优化

Guo Tang, HongJie Luo, Tianxu Wang, Ying Zhang, Hao Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) Guangdong University of Technology(广东工业大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 针对文本到图像生成模型对提示制定敏感的问题,提出PRISM框架,通过基于图像的自我奖励机制,利用结构化视觉诊断和多任务监督微调等方法,提高图像质量和语义对齐,并提供可解释反馈。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24176 2026-07-28 cs.CL cs.LG 新提交 57%

Where Quality Breaks in Compressed Short-Text Generation: Staged Bottleneck Localization

压缩短文本生成中的质量断点在哪里:阶段式瓶颈定位

Alexey Gavrilov, Alan-Barsag Gazzaev, Sergey Muravyov

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究压缩短文本生成中质量断点问题,通过阶段式验证协议,在TinyStories案例中分离编解码器与潜在生成器影响,发现编解码器保真度是质量瓶颈,提出可重复使用的阶段式诊断方法,为质量问题研究提供新思路。

Comments 8 pages, 3 figures, 14 tables. Published in the Proceedings of FRUCT'39

Journal ref Proceedings of the 39th Conference of the Open Innovations Association FRUCT (FRUCT'39), 2026, pp. 69-76

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22740 2026-07-28 cs.CV 新提交 57%

A Diagnostic Gap Framework for Evaluating Reconstruction Fidelity in Weakly Supervised Mammography

用于评估弱监督乳腺X线摄影中重建保真度的诊断差距框架

Vinceline Bertrand, Ionut Cardei

专题命中 诊断辅助 :pathology(abstract);分类 cs.CV

AI总结 研究针对弱监督医学成像系统各阶段临床信息保留评估有限的问题,提出诊断差距框架,通过对特定病变ROI作物评估三个重建器,依重建保真度衡量决策与解释保留,能识别多阶段管道何时何地丢失诊断信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03484 2026-07-28 eess.AS cs.LG cs.SD 版本更新 57%

Dementia classification from spontaneous speech using wrapper-based feature selection

基于自发语音的痴呆症分类:基于包装的特征选择

Marko Niemelä, Mikaela von Bonsdorff, Sami Äyrämö, Tommi Kärkkäinen

机构 * Faculty of Information Technology, University of Jyväskylä(信息科技学院,于韦斯屈莱大学) Public Health Programme, Folkhälsan Research Center(公共卫生计划,福尔哈兰研究中心) Faculty of Sport and Health Sciences and Gerontology Research Center, University of Jyväskylä(体育与健康科学学院及老年学研究中心,于韦斯屈莱大学) Wellbeing Services County of Central Finland(中央芬兰福祉服务县)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 本文通过分析自发语音数据,利用包装法特征选择模型,提出高效且可解释的痴呆症分类方法,证明极端最小学习机在计算效率和分类精度上的优势。

Journal ref Applied Computing and Intelligence, 2026, 6(1): 89-114

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12351 2026-07-28 cs.CV 版本更新 57%

Fundus Image-based Glaucoma Screening via Retinal Knowledge-Oriented Dynamic Multi-Level Feature Integration

基于视网膜图像的青光眼筛查:面向视网膜知识的动态多级特征整合

Chi Liu, Yuzhuo Zhou, Sheng Shen, Zongyuan Ge, Fengshi Jing, Shiran Zhang, Yu Jiang, Anli Wang, Wenjian Liu, Feilong Yang, Tianqing Zhu, Xiaotong Han

机构 * State Key Laboratory of Ophthalmology, Zhongshan Ophthalmic Center, Sun Yat-sen University, Guangdong Provincial Key Laboratory of Ophthalmology and Vision Science, Guangdong Provincial Clinical Research Center for Ocular Diseases(眼科学国家重点实验室、中山眼科中心、中山大学、广东省眼科学重点实验室和视觉科学、广东省眼科临床研究中心) Faculty of Data Science, City University of Macau(澳门城市大学数据科学学院) Hainan International College, Minzu University of China(海南国际学院,中国民族大学) School of Information Technology, Faculty of Business and Hospitality, Torrens University Australia(澳大利亚托伦斯大学信息科技学院,商业与酒店管理学院) AIM for Health Lab, Faculty of IT, Monash University, Australia(健康AIM实验室,墨尔本大学IT学院,澳大利亚) Department of Ophthalmology, Guangzhou First People’s Hospital, the Second Affiliated Hospital of South China University of Technology(广州第一人民医院,华南理工大学第二附属医院) The Third Xiangya Hospital of Central South University(中南大学湘雅医学院第三医院)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 本文提出基于视网膜知识的动态多级特征整合框架,通过动态窗口机制和知识增强卷积注意力模块提升青光眼筛查的鲁棒性,实验表明其在AIROGS数据集上达到98.5%的AUC和94.6%的准确率。

Comments 15 pages. Published in Knowledge-based System

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22385 2026-07-27 cs.AI cs.LG 新提交 57%

Agentic Root Cause Analysis through Evidence-Grounded Reasoning

通过基于证据的推理进行智能根本原因分析

Amaury Wei, Olga Fink

机构 * EPFL - IMOS Laboratory(洛桑联邦理工学院 - IMOS实验室)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究针对工业异常根本原因诊断依赖人工且现有数据驱动方法有局限的问题,提出AgentRCA框架,结合数字孪生和大语言模型进行推理,在实际设施上评估,性能与监督基线相当且能产生透明推理轨迹,为工业根本原因分析提供实用基础。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21680 2026-07-27 cs.LG 新提交 57%

Encoding Invisible Causation for Bridge Diagnostic Agents: Triple-Guided Retrieval-Augmented Fine-Tuning with QLoRA

为桥梁诊断代理编码无形因果关系:基于QLoRA的三重引导检索增强微调

Takato Yasuno

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究针对桥梁损伤原因难以肉眼察觉及专家诊断依赖隐性知识的问题,提出基于QLoRA的三重引导检索增强微调方法(含知识三元组提取等组件),能在消费级硬件上实现内存高效、高精度的桥梁诊断代理。

Comments 13 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20780 2026-07-24 cs.CV 新提交 57%

Rethinking Open-World Video Anomaly Detection: Diagnosing Definition Blindness

重新思考开放世界视频异常检测:诊断定义盲目性

Inpyo Song, Jangwon Lee

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 研究开放世界视频异常检测中定义盲目性问题,分解动态定义评估,引入三个定义条件评估指标及DeCoS,指出OWVAD应按定义条件异常评分评估,改进了多个基线模型的定义跟随能力。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20521 2026-07-24 cs.LG stat.ML 新提交 57%

Generative Bayesian Filtering for State Estimation

用于状态估计的生成式贝叶斯滤波

Lei Cao, Sihang Feng, Jixin Yan, Tao Sun, Naichen Shi

机构 * Northwestern University(西北大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究动态系统状态估计问题,提出生成式贝叶斯滤波框架GBF,用预训练条件生成模型取代简单观测模型,经贝叶斯预测-更新递归及转化,实验证明其提升了状态估计的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28241 2026-07-24 cs.CV 57%

PointQ-Bench: Benchmarking Diagnostic and Interpretable Point Cloud Quality Assessment

PointQ-Bench:诊断性和可解释的点云质量评估基准

Duanchu Wang, Cheng Li, Junjie Yang, Jing Huang, Zihang Cheng, Zhi Gao, Bohong Zhu, Di Wang

机构 * Xi’an Jiaotong University(西安交通大学) Xidian University(西安电子科技大学) University of Chinese Academy of Sciences(中国科学院大学) Ningxia University(宁夏大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 提出PointQ-Bench基准,通过异常感知、缺陷诊断、可用性分级和开放式质量报告任务,将点云质量评估从标量评分扩展到全面质量理解,并揭示当前模型在感知与诊断之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05881 2026-07-24 cs.LG cs.CL cs.RO 57%

Training Fast Robot Policies with Slow Foundation Models

用慢速基础模型训练快速机器人策略

Utsav Singh, Pramit Bhattacharyya, Vinay P. Namboodiri, Amrit Singh Bedi

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 本文提出VGRS方法,通过利用慢速基础模型训练快速机器人策略,结合LLM生成奖励与视觉分析诊断,提升机器人在复杂任务中的表现和部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11780 2026-07-24 stat.ME cs.CV stat.ML 版本更新 57%

Multivariate Planar Curves: A Statistical Framework for Shape Analysis in Images

多元平面曲线:图像形状分析的统计框架

Issam-Ali Moindjié, Cédric Beaulac, Marie-Hélène Descary

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 研究在图像分析的监督分类中用对象轮廓作预测器,开发多元平面曲线统计学习框架,联合建模轮廓保留组件信息,扩展相关工具,经模拟和心脏肥大检测问题验证,该框架能准确恢复参数并提高分类准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19635 2026-07-23 cs.LG cs.AI 新提交 57%

Anatomy of a Sound Neural Reasoner: One-Shot Amortization, First-Pass Poisoning, and Search Inertness in Clue-Rich Completion

一个合理的神经推理器剖析:在富含线索的填数问题中的一次性摊销、首次通过中毒和搜索惰性

Aleksey Komissarov

机构 * Neapolis University, Pafos(帕福斯新帕福斯大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究富含线索填数问题中神经推理器的表现,发现LDT存在首次通过中毒等问题,添加CoLT可减少无效推导,还给出两种干预措施提升准确率,指出类似LDT系统是一次性摊销预测器,搜索主要消除计算浪费。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17507 2026-07-21 cs.LG 新提交 57%

Residual-Guided Multi-Resolution Refinement of Foundation Models: A Case Study in Drought Forecasting

基础模型的残差引导多分辨率细化:干旱预测案例研究

Wentao Gao, Jiuyong Li, Lin Liu, Thuc Duy Le, Jixue Liu, Yanchang Zhao, Yun Chen

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究针对区域气候预测中时间序列基础模型的挑战,提出残差引导多分辨率细化框架RGMR,无需更新主干参数,应用于干旱预测时能降低测试集MSE,为部署冻结的TSFM提供实用途径。

Comments 23 pages, ICML2026 Accepted Paper(Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16244 2026-07-21 cs.LG cs.AI cs.CL 新提交 57%

CIGPO: Contextual Information-Gain Policy Optimization for Multi-Turn Evidence-Reading LLM Agents

CIGPO:用于多轮证据阅读语言模型代理的上下文信息增益策略优化

Hao Dou

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究多轮证据阅读语言模型代理训练不稳定问题,提出CIGPO方法,通过方差注入策略,利用冻结参考模型对数似然边际增加作逐轮信号,避免奖励方差崩溃,在HotpotQA实验中取得更好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09249 2026-07-21 cs.CV 版本更新 57%

DECIS: Dual-Evidence Corrective Verification for Interpretable Strabismus Diagnostic Decision-Making

MAGIS:基于证据的多智能体推理用于可解释的斜视临床决策

Xikai Tang, Yifan Wang, Jiafan Zhuang, Li Luo, Jinming Guo, Xiaoling Xie, Jiacheng Liu, Peiwei Wei, Lihao Zhong, Xiaoli Kang, Jie Cen, Guangqiang Yin, Kunliang Qiu, Ce Zheng, Zhun Fan

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(电子科技大学深圳高等研究院) Joint Shantou International Eye Center of Shantou University and The Chinese University of Hong Kong(汕头大学·香港中文大学联合汕头国际眼科中心) School of Artificial Intelligence, Guangzhou City Polytechnic(广州城市职业学院人工智能学院) Medical College, Shantou University(汕头大学医学院) College of Engineering, Shantou University(汕头大学工学院) Department of Ophthalmology, Xinhua Hospital Affiliated to Shanghai Jiaotong University School of Medicine(上海交通大学医学院附属新华医院眼科) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 提出MAGIS框架,通过多智能体协作、双重证据约束上下文和基于证据的纠正验证机制,将斜视诊断从黑箱生成转变为结构化推理,在细粒度斜视基准上将加权F1分数从72.0%提升至91.3%,并显著提高诊断报告的临床可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16122 2026-07-20 cs.AI cs.LG 新提交 57%

CRAFT: Clustering Rubrics to Diagnose Weak LLM Capabilities and Generate Targeted Fine-Tuning Data

CRAFT:聚类评分标准以诊断大型语言模型的能力短板并生成针对性的微调数据

Vipul Gupta, Zihao Wang, Razvan-Gabriel Dumitru, MohammadHossein Rezaei, Aakash Sabharwal, Yunzhong He

机构 * Scale AI(Scale人工智能公司)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 研究针对评估应指导模型改进及提供训练数据的问题,提出CRAFT方法,将评分标准评估数据集转化为模型能力短板诊断,通过聚类能力描述、评估模型节点等生成微调数据,实验表明该方法能更精准诊断模型弱点并提升性能。

Comments 18 pages, 3 Tables, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏