EvoHarness-RL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents
EvoHarness-RL:为长视野大语言模型智能体学习自进化运行时管控器
机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Meta AI
AI总结 本研究提出 EvoHarness-RL 方法,通过学习管控器策略解决长视野 LLM 智能体的外部状态管理问题,在 ALFWorld 上达到 96.9% 的任务成功率,验证了可训练管控器策略的有效性。
Comments Accepted to LLA@COLM 2026