Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs
Stronger-MAS: 多智能体强化学习用于协作大语言模型
机构 * University of California, San Diego(加州大学圣地亚哥分校) ; Intel Corporation(英特尔公司)
AI总结 Stronger-MAS提出了一种针对多智能体强化学习的AT-GRPO算法,通过改进的分组策略和训练系统,在多个任务中显著提升了大语言模型的性能。