OccVLA: Vision-Language-Action Model with Implicit 3D Occupancy Supervision
机构 * Shanghai Qi Zhi Institute(上海启智研究所) ; Xi’an Jiaotong University(西安交通大学) ; Fudan University(复旦大学) ; Shanghai Jiao Tong University(上海交通大学) ; Tsinghua University(清华大学)
专题命中 VLA模型 :vision-language-action(title);action model(title);分类 cs.RO、cs.AI