Legibility is Not Interpretability: Comparing Judged and Actual Importance in Chain-Of-Thought Reasoning
可解释性≠可理解性:对比思维链推理中的主观判断重要性与实际重要性
机构 * ETH Zürich(苏黎世联邦理工学院) ; MIT(麻省理工学院) ; Cohere(科here公司)
AI总结 该研究对比思维链推理的可理解性与实际重要性,发现LLM评判识别高优势步骤的能力有限,微调步骤级批评家仅对错误响应有效,警示勿将推理轨迹可理解性等同于可解释性。
Comments Published at COLM 2026