OG-VLA: Orthographic Image Generation for 3D-Aware Vision-Language Action Model
机构 * University of Southern California(美国南加州大学) ; NVIDIA(英伟达)
专题命中 VLA模型 :VLA(title,abstract);action model(title,abstract);vision language action(abstract);分类 cs.RO、cs.CV、cs.AI
Comments 13 pages