Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG
机构 * National Key Lab of Autonomous Intelligent Unmanned Systems, Beijing Institute of Technology, Beijing 100081, China(自主智能无人系统国家重点实验室,北京理工大学,北京100081,中国) ; Department of Control Science and Engineering, Harbin Institute of Technology, Harbin 150001, China(控制科学与工程学院,哈尔滨工业大学,哈尔滨150001,中国)
专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI
机构 * Improbable AI Lab, MIT(Improbable AI Lab 和 马萨诸塞理工学院)
专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG