ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
ConMax:用于高效思维链推理的置信度最大化压缩
机构 * The Chinese University of Hong Kong(香港中文大学) ; LLM Department, Tencent(腾讯机器学习部门)
专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 ConMax通过强化学习框架在保持推理模式的同时,高效压缩推理轨迹,提升大规模推理模型的效率与性能