Spatial-Aware VLA Pretraining through Visual-Physical Alignment from Human Videos
通过人类视频中的视觉-物理对齐实现空间感知的VLA预训练
机构 * Peking University(北京大学) ; Renmin University of China(中国人民大学) ; BeingBeyond
专题命中 机器人基础模型 :robot learning(abstract);robot policy(abstract);robotic(abstract);分类 cs.RO
AI总结 通过人类视频中的视觉-物理对齐实现空间感知的VLA预训练,提升机器人任务的稳健性和通用性。