Breadcrumbs Reasoning: Memory-Efficient Reasoning with Compression Beacons
痕迹推理:通过压缩信标实现的内存高效推理
机构 * Cornell University(康奈尔大学) ; Harvard University(哈佛大学)
AI总结 本研究提出通过压缩信标实现内存高效推理,利用联合蒸馏和强化学习框架优化缓存压缩,提升大语言模型在长上下文推理中的内存与准确性平衡。
高校专区
痕迹推理:通过压缩信标实现的内存高效推理
机构 * Cornell University(康奈尔大学) ; Harvard University(哈佛大学)
AI总结 本研究提出通过压缩信标实现内存高效推理,利用联合蒸馏和强化学习框架优化缓存压缩,提升大语言模型在长上下文推理中的内存与准确性平衡。