EchoRL: Reinforcement Learning via Rollout Echoing
EchoRL:通过回滚回响进行强化学习
机构 * Munich Center for Machine Learning(慕尼黑机器学习中心) ; Huawei Heisenberg Research Center(华为海森堡研究所以) ; University of Arizona(亚利桑那大学) ; College of Computing(计算学院) ; Data Science, Nanyang Technological University, Singapore(数据科学,南洋理工大学,新加坡) ; MemAgents Lab(MemAgents实验室)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 针对RLVR训练中优势退化问题,提出EchoRL模块,通过从成功回滚中提取EchoClip作为辅助监督信号,持续提升训练性能。
Comments ICML 2026