arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Pennsylvania(宾夕法尼亚大学)

2026-08-31 至 2026-08-31 共收录 1
2608.28482 2026-08-31 cs.LG cs.AI 新提交

How Proper Scoring Rules Shape LLM Forecasting

恰当评分规则如何塑造大语言模型(LLM)的预测

Benjamin Turtel, Paul Wilczewski, Kris Skotheim, Ville A. Satopää, Philip E. Tetlock

机构 * Lightning Rod Labs(闪电杆实验室) INSEAD(欧洲工商管理学院) School of Arts & Sciences, University of Pennsylvania(宾夕法尼亚大学文理学院)

AI总结 本文研究了5种恰当评分规则作为训练目标对LLM预测的影响,发现不同规则训练的模型在校准、概率使用等方面有差异,Brier训练模型表现最优。

详情

展开后加载摘要…

URL PDF HTML 收藏