Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents
回望以推导前行:用于长上下文LLM代理的可回溯记忆
机构 * University of Science and Technology of China(中国科学技术大学) ; National University of Singapore(新加坡国立大学) ; Shanghai Jiao Tong University(上海交通大学) ; DP Technology(DP科技) ; Meituan(美团)
专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL
AI总结 ReMemR1通过整合记忆检索机制和多级奖励设计,提升长上下文问答任务的推理能力与效率。