STGFormer: Spatio-Temporal GraphFormer for 3D Human Pose Estimation in Video
机构 * Sun Yat-sen University, School of Electronics and Communication Engineering(中山大学电子与通信工程学院)
专题命中 VLA模型 :action model(abstract);分类 cs.CV
视觉与机器人
视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。
机构 * Sun Yat-sen University, School of Electronics and Communication Engineering(中山大学电子与通信工程学院)
专题命中 VLA模型 :action model(abstract);分类 cs.CV