arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-02-09 至 2026-02-09 共收录 4
2602.06948 2026-02-09 cs.AI cs.LG

Agentic Uncertainty Reveals Agentic Overconfidence

代理不确定性揭示代理过度自信

Jean Kaddour, Srijan Patel, Gbètondji Dovonon, Leo Richter, Pasquale Minervini, Matt J. Kusner

机构 * University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学) Mila - Québec AI Institute(魁北克AI研究所)

AI总结 研究发现AI代理在任务执行前后对自身成功率的预测存在过度自信,且执行前的低信息评估比执行后的回顾更有效,对抗性提示能提高预测准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06843 2026-02-09 cs.CL cs.AI

The Representational Geometry of Number

数字的表征几何

Zhimin Hu, Lanhao Niu, Sashank Varma

机构 * Georgia Tech(佐治亚理工学院) University of Edinburgh(爱丁堡大学)

AI总结 本研究通过语言模型探讨数字表征的几何结构,发现任务特定表征可通过线性映射在不同子空间间转换,揭示了共享结构与功能灵活性的平衡机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06652 2026-02-09 cs.AI cs.CV

Same Answer, Different Representations: Hidden instability in VLMs

相同答案,不同表示:VLMs中的隐藏不稳定性

Farooq Ahmad Wani, Alessandro Suglia, Rohit Saxena, Aryo Pradipta Gema, Wai-Chung Kwan, Fazl Barez, Maria Sofia Bucarelli, Fabrizio Silvestri, Pasquale Minervini

机构 * Sapienza University of Rome(罗马萨皮恩扎大学) CNRS(法国国家科学研究中心) University of Edinburgh(爱丁堡大学) University of Oxford(牛津大学) i3S(i3S研究所)

AI总结 本研究揭示了视觉语言模型中隐藏的不稳定性,通过引入新的评估框架发现模型在内部表示漂移、鲁棒性与决策边界等方面存在显著问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18659 2026-02-09 cs.CL

CLaRa: Bridging Retrieval and Generation with Continuous Latent Reasoning

CLaRa:通过连续潜在推理弥合检索与生成

Jie He, Richard He Bai, Sinead Williamson, Jeff Z. Pan, Navdeep Jaitly, Yizhe Zhang

机构 * Apple(苹果公司) University of Edinburgh(爱丁堡大学)

AI总结 CLaRa通过连续潜在推理框架实现检索与生成的统一优化,提升压缩和重排性能,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏