Flow Policy Gradients for Robot Control
用于机器人控制的流匹配策略梯度
机构 * Amazon FAR(亚马逊Far) ; UC Berkeley(加州大学伯克利分校) ; Stanford(斯坦福大学) ; HKU(香港大学) ; CMU(卡内基梅隆大学)
AI总结 本文提出了一种基于流匹配的策略梯度方法,用于训练更复杂的机器人控制策略,实现了在四肢运动、人形运动跟踪和操作任务中的成功,并展示了在仿真到现实迁移中的鲁棒性。
Comments Project webpage: https://hongsukchoi.github.io/fpo-control