arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Together AI

2025-12-08 至 2025-12-08 共收录 1
2512.05925 2025-12-08 cs.AI cs.CL

To Err Is Human: Systematic Quantification of Errors in Published AI Papers via LLM Analysis

出错是人之常情:通过LLM分析系统性量化已发表AI论文中的错误

Federico Bianchi, Yongchan Kwon, Zachary Izzo, Linjun Zhang, James Zou

机构 * Together AI NEC Labs America(NEC美国实验室) Rutgers University(罗格斯大学) Stanford University(斯坦福大学)

AI总结 通过LLM分析发现已发表AI论文中存在大量客观错误,错误数量随时间增加,AI检查器能有效识别并纠正大部分错误,提升文献的准确性和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏