Eliciting Chain-of-Thought in Base LLMs via Gradient-Based Representation Optimization
通过基于梯度的表示优化在基础LLM中引导链式思维
机构 * Zijian Wang, Yanxiang Ma, Chang Xu(作者)
专题命中 数学推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);logical reasoning(abstract)
AI总结 本文提出了一种基于概率条件生成的隐藏状态优化方法,通过梯度优化提升基础LLM的链式思维推理能力,有效解决隐藏状态操纵中的分布偏移问题。
Comments AAAI2026