Circular Reasoning: Understanding Self-Reinforcing Loops in Large Reasoning Models
循环推理:理解大推理模型中的自增强循环
机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室) ; University of Chinese Academy of Sciences(中国科学院大学) ; People’s Public Security University of China(中国人民公安大学)
AI总结 本文提出LoopBench数据集和CUSUM算法,用于识别和预测大型推理模型中的自增强循环问题,揭示循环推理的机理并提升模型稳定性。