Dynamic Long Context Reasoning over Compressed Memory via End-to-End Reinforcement Learning
通过端到端强化学习实现压缩内存中的动态长上下文推理
专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI
AI总结 本文提出了一种基于端到端强化学习的框架,通过分块压缩和选择性记忆回溯实现高效长上下文推理,提升了多跳推理任务的准确性和效率。
Comments 26 pages, 7 figures. Code and models will be released