Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
将元经验内化到记忆中以指导大语言模型的强化学习
专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG
AI总结 通过将元经验内化到记忆中,MEL提升了大语言模型的强化学习效果,实现了更有效的知识重用和推理能力增强。