Rewarding Intellectual Humility Learning When Not To Answer In Large Language Models
在大型语言模型中不回答时如何奖励智力谦逊学习
机构 * University of Southern California(南加州大学) ; Los Angeles, United States of America(美国洛杉矶)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出通过可验证奖励强化学习促进大型语言模型的智力谦逊,通过调整回避奖励机制减少错误响应,提升模型可靠性。