arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-08-20 至 2025-08-20 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2407.10099 2025-08-20 cs.CV 57%

STGFormer: Spatio-Temporal GraphFormer for 3D Human Pose Estimation in Video

Yang Liu, Zhiyong Zhang

机构 * Sun Yat-sen University, School of Electronics and Communication Engineering(中山大学电子与通信工程学院)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏