Training Large Language Models to Reason in a Continuous Latent Space
训练大型语言模型在连续潜在空间中进行推理
机构 * FAIR at Meta(Meta 的 FAIR)
专题命中 逻辑推理 :CoT(summary_cn,abstract);chain-of-thought(abstract,abstract_cn);reasoning(abstract);planning(abstract)
AI总结 本文提出名为Coconut的连续思维链新范式,将LLM推理状态表示为连续潜在空间中的隐藏状态,支持广度优先搜索,在需大量搜索的逻辑推理任务上优于CoT,实现更优的准确率效率权衡。
Comments Accepted to COLM 2025