Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
直接置信对齐:将 verbalized 置信度与内部置信度对齐于大语言模型
机构 * Algoverse AI Research(Algoverse AI研究院)
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)
AI总结 本文提出直接置信对齐方法,通过优化使LLM的 verbalized 置信度与内部置信度对齐,提升模型透明度和可靠性。
Comments Accepted at ACL 2025 SRW, 5 pages body, 14 pages total