WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ; ByteDance Seed(字节跳动种子)
专题命中 模仿学习与强化学习 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI
Comments project website: https://wm-po.github.io