LightThinker++: From Reasoning Compression to Memory Management
LightThinker++:从推理压缩到内存管理
机构 * Zhejiang University(浙江大学)
专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出LightThinker++,通过引入显式自适应内存管理,有效压缩LLM推理过程中的中间思维,减少内存占用并提升推理效率,尤其在长周期智能任务中表现突出。
Comments Work in progress. This is an extended version of LightThinker