When Agents Say One Thing and Do Another: Validating Elicited Beliefs from LLMs
当代理人言辞与行为不一致时:从LLMs中验证提取的信念
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Microsoft Research(微软研究院)
专题命中 Agent评测 :agent(abstract);分类 cs.AI
AI总结 本文提出一种决策理论框架,通过提取概率判断和决策并检验其一致性,验证LLMs的信念是否合理,发现最强模型的不一致程度较小。