Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning
为高效的大规模基于LLM的多智能体强化学习设计rollout训练
机构 * Huawei(华为公司) ; Huazhong University of Science and Technology(华中科技大学)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG
AI总结 FlexMARL通过端到端训练框架优化rollout与训练协调,实现大规模基于LLM的多智能体强化学习的高效训练。