Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
操纵法官:不忠的推理链可能损害智能体评估
机构 * University of Michigan(密歇根大学) ; LG AI Research(LG人工智能研究) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 推理评测 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文揭示了LLM法官对智能体推理轨迹操纵的脆弱性,表明基于内容的操纵能显著提高假阳性率,凸显了需验证推理与证据的评估机制的重要性。