GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data
专题命中 部署与泛化 :vision-language-action(abstract);VLA(abstract);action model(abstract);embodied foundation model(abstract)
视觉与机器人
视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。
专题命中 部署与泛化 :vision-language-action(abstract);VLA(abstract);action model(abstract);embodied foundation model(abstract)