arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-10 至 2025-12-10 共收录 1 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 1 篇

2512.04463 2025-12-10 cs.AI cs.RO 73%

MARL Warehouse Robots

多智能体强化学习在仓库机器人中的应用

Price Allman, Lian Thang, Dre Simmons, Salmon Riaz

机构 * Department of Computer Science, Oral Roberts University(计算机科学系,奥尔巴尼罗尔斯大学)

专题命中 模仿学习与强化学习 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文比较了MARL算法在仓库机器人中的性能,发现QMIX在奖励回报上显著优于IPPO,但需大量超参数调优,适用于小规模部署但存在扩展挑战。

Comments 5 pages.Project documentation: https://pallman14.github.io/MARL-QMIX-Warehouse-Robots/

详情

展开后加载摘要…

URL PDF HTML 收藏