arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-08-27 至 2026-08-27 共收录 12 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 12 篇

2608.24934 2026-08-27 cs.CV cs.AI 新提交 79%

Fusing Perceptual Vision Experts with Multimodal Large Language Models for Explainable Plant Disease Diagnosis: From Benchmark Imagery to Real-World Robotic Field Validation

融合感知视觉专家与多模态大语言模型的可解释植物病害诊断:从基准图像到真实世界机器人现场验证

Ranjan Sapkota, Konstantinos I. Roumeliotis, Pengyao Xie, Nikolaos D. Tselikas, Lirong Xiang, Manoj Karkee

机构 * Cornell University(康奈尔大学) University of the Peloponnese(伯罗奔尼撒大学) Agricultural University of Athens(雅典农业大学)

专题命中 诊断辅助 :diagnosis(title,abstract);分类 cs.CV

AI总结 该研究提出H²MAF框架,结合EfficientNet-B3、ConvNeXt-Tiny与Gemma、Qwen等MLLM,在PlantDoc及Cornell机器人田间数据集上实现高准确率可解释植物病害诊断,验证了MLLM仲裁的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25730 2026-08-27 cs.CR 新提交 78%

From Verdict to Diagnosis: Attributable Security Review of Pull Requests

从裁决到诊断:对拉取请求的可归因安全审查

Zhuo Chen, Boyang Wang, Xiyue Zhang, Xiaoyun Xu, Ahmad-Reza Sadeghi, Stjepan Picek, Lichao Wu

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 研究针对自动化PR审查的裁决-诊断差距,构建MalPR-Bench基准,提出PRGuard审查工具,发现仅基于裁决的评估会高估自动化审查的安全价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24908 2026-08-27 cs.HC cs.CY 新提交 78%

Hallucination by proxy in LLM-assisted differential diagnosis

LLM辅助鉴别诊断中的代理幻觉

Bastien Le Guellec, Su-Hwan Kim, Ibrahima Niang, Aghiles Hamroun, Grégory Kuchcinski

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 该研究发现,亚专业经验有限的放射科医生(尤其是培训6个月以内者)易将LLM生成的虚构疾病纳入鉴别诊断,需开展AI内容批判性评估的结构化培训。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01666 2026-08-27 cs.CL cs.AI 版本更新 71%

Style Wins, Substance Loses: A Diagnosis of LLM-as-Judge in Idea Generation

风格取胜,实质落败:对作为创意生成评判者的大语言模型(LLM)的诊断

Fengxian Ji, Yuke Li, Jingpu Yang, Juanfan Wu, Fan Zhang, Zhexuan Cui, Yu Xie, Min Peng, Qianqian Xie, Xiuying Chen, Zhuohan Xie

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对大语言模型作为创意评判者的风格偏差问题,提出SciStyleBench基准及配套的SciStyleExtractor模块,实验验证该模块可有效降低风格偏差、提升实质区分度,为科学创意评估提供了系统性解决方案。

Comments First three authors are co-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25028 2026-08-27 cs.CL cs.LG 新提交 57%

Behind the [MASK]: Disentangling Representation and Faithfulness in DAPF-Based Dementia Detection

[MASK]背后:基于DAPF的痴呆检测中表征与忠实性的解耦

Pardis Ranjbar-Noiey, Natalie Parde

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 该研究针对基于提示微调的领域自适应模型(DAPF)框架,探究其在痴呆检测任务中的表征优势与标记级解释忠实性不匹配的问题,为痴呆筛查模型的可解释性优化提供了依据。

Comments 16 pages, 1 figure, 19 tables. Under review at ACL Rolling Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24966 2026-08-27 cs.CV cs.AI 新提交 57%

Targeting the Attention Heads Behind Object Hallucination in LLaVA

针对LLaVA中物体幻觉背后的注意力头

Armaan Sandhu, Abhilasha Senapati, Hima Kammachi

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.CV

AI总结 本研究针对LLaVA的物体幻觉问题,通过注意力头诊断筛选出32个关键注意力头,结合LoRA适配器与推理控制器,在COCO数据集上显著降低了物体幻觉率。

Comments 10 pages, 5 figures, 3 tables. Accepted at the Actionable Interpretability Workshop, COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03297 2026-08-27 cs.CL cs.AI cs.LG 版本更新 57%

TTSR: Test-Time Self-Evolving via Reflection

TTSR: 测试时自我反思以提升持续推理能力

Haoyang He, Zihua Rong, Yunjia Zhao, Lan Yang, Jian Chang, Honggang Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Southwestern University of Finance and Economics(西南财经大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 TTSR通过测试时自我反思机制,利用学生与教师角色交替,持续改进大语言模型的推理能力。

Comments EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25384 2026-08-27 eess.AS 新提交 50%

Mandarin Humorous Homophone Recognition and Disambiguation in Automatic Speech Recognition

自动语音识别中的中文幽默同音字识别与歧义消解

Sicheng Jin, Jinghao Chen, Mostafa Shahin, Beena Ahmed, Aditya Joshi

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究针对第二语言中文发音学习的MDD需求,提出基于音系特征的Wav2Vec2-CTC框架,区分音段与声调错误,可降低FAR与DER,提供更详细的诊断反馈。

Comments Accepted for publication at ISCSLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25661 2026-08-27 cs.SE cs.AI 新提交 50%

From General Agents to RCA Experts: A Self-Evolving Harness for Root Cause Analysis

从通用智能体到RCA专家:一种用于根因分析的自演化框架

Haiyu Huang, Jiewei Lyu, Zhihan Jiang, Jinyang Liu, Xiao He, Tieying Zhang, Wu Xiang, Michael R. Lyu

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究提出自演化RCA框架OpsHarness,复用通用智能体能力,通过双门验证演化,在基准与工业场景中大幅提升RCA准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22899 2026-08-27 cs.AI 版本更新 50%

CDEG: Learning Decision-Critical Evidence for Long-Horizon Diagnostic Agents

CDEG:为长程诊断智能体学习决策关键证据

Xiwei Dai, Zijie Meng, Zhiting Fan, Yixuan Tang, Guanyu Jiang, Ziru Niu, Zuozhu Liu

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本研究提出基于图的框架CDEG,通过对比同一病例的成功与失败轨迹、受控反事实干预等学习决策关键证据,在多基准测试中使长程诊断智能体准确率最高提升11.5%。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02550 2026-08-27 stat.ME 版本更新 50%

A Joint Bayesian Boolean Matrix Factorization with Application to Chromosomal Copy Number Alterations in Multiple Myeloma

联合贝叶斯布尔矩阵分解及其在多发性骨髓瘤染色体拷贝数变异中的应用

Adolphus Wagala, Samur Mehmet, Giovanni Parmigiani

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究针对现有布尔矩阵分解未利用相关数据集共享潜在结构的问题,提出JBBMF模型,通过共享潜在结构联合分解二元矩阵,在模拟和多发性骨髓瘤数据应用中提升了因子恢复与分析效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03542 2026-08-27 cs.CL cs.AI 版本更新 50%

Layer-Order Inversion: Rethinking Latent Multi-Hop Reasoning in Large Language Models

层序倒置:重新思考大语言模型中的潜在多跳推理

Xukai Liu, Ye Liu, Jipeng Zhang, Yanghai Zhang, Kai Zhang, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出"层序倒置"现象,通过概率性回忆与提取框架解释大语言模型中多跳推理的机制,揭示了层序倒置与总跳步数的关系,并提供了多跳失败的诊断方法。

Comments 16 pages, 18 figures, EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏