Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning
通过分层共自博弈强化学习掌握多无人机 volleyball
机构 * Tsinghua University(清华大学)
AI总结 本文提出分层共自博弈强化学习框架,通过三阶段训练流水线实现多无人机volleyball任务的高水平战略协调与低水平敏捷控制,实验显示其在胜率和团队行为涌现方面的优越性能。
Comments Accepted by CoRL 2025