VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
机构 * Westlake University(西湖大学) ; Zhejiang University(浙江大学) ; OpenHelix Team(OpenHelix团队) ; Fudan University(复旦大学) ; Zhengzhou University(郑州大学) ; BUPT(北京邮电大学) ; Hebei University of Technology(河北工业大学)
专题命中 机器人基础模型 :world model(abstract);分类 cs.RO、cs.CV