arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Microsoft(微软)

2026-04-06 至 2026-04-06 共收录 3
2604.02543 2026-04-06 cs.CV cs.LG

Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation

过度自信与校准在医学视觉问答中的研究:实证发现与幻觉意识缓解

Ji Young Byun, Young-Jin Park, Jean-Philippe Corbeil, Asma Ben Abacha

机构 * Johns Hopkins University, School of Medicine(约翰霍普金斯大学医学院) Massachusetts Institute of Technology(麻省理工学院) Microsoft Healthcare & Life Sciences(微软医疗健康与生命科学)

AI总结 本文研究了医学VQA中VLMs的过度自信问题,发现校准方法如Platt缩放能有效提升校准精度,但无法提升预测区分度,提出幻觉意识校准方法以提高可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00361 2026-04-06 cs.HC cs.AI

Attribution Gradients: Incrementally Unfolding Citations for Critical Examination of Attributed AI Answers

归因梯度:逐步展开引用以批判性审查归因AI答案

Hita Kambhamettu, Alyssa Hwang, Philippe Laban, Andrew Head

机构 * University of Pennsylvania(宾夕法尼亚大学) Microsoft Research(微软研究院)

AI总结 本文提出归因梯度技术,通过整合证据量、支持/矛盾摘录、源链接和上下文解释,提升引用信息的清晰度,并能展开二级引用,提升批判性阅读任务中的深度理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06128 2026-04-06 cs.LG stat.ML

Amortized Inference of Causal Models via Conditional Fixed-Point Iterations

通过条件固定点迭代实现因果模型的 amortized 推断

Divyat Mahajan, Jannes Gladrow, Agrin Hilmkil, Cheng Zhang, Meyer Scetbon

机构 * Mila, Université de Montréal(蒙特利尔大学米拉研究所) Microsoft Research(微软研究院)

AI总结 本文提出一种 amortized 推断框架,通过条件固定点迭代推断因果模型的因果机制,能够在不更新参数的情况下生成观测和干预数据,实验表明其在数据稀缺时表现更优。

Comments Transactions on Machine Learning Research (TMLR) 2025 (J2C Certification). ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏