arXivDaily arXiv每日学术速递 周一至周五更新

作者

Percy Liang

Natural Language Processing

2026-01-14 至 2026-01-14 共收录 1
2511.11966 2026-01-14 cs.CL cs.AI cs.LG stat.ML

On the Entropy Calibration of Language Models

对语言模型熵校准的研究

Steven Cao, Gregory Valiant, Percy Liang

机构 * Stanford University(斯坦福大学)

AI总结 本文研究了语言模型的熵校准问题,发现随着模型规模增大,校准误差缓慢改善,但截断方法会增加对数损失,理论证明在假设可预测文本熵的情况下,可以减少熵而不增加对数损失。

Comments Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏