arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-08-14 至 2025-08-14 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 数据集与评测 1 篇

2508.09404 2025-08-14 cs.CV cs.MM 74%

Waymo-3DSkelMo: A Multi-Agent 3D Skeletal Motion Dataset for Pedestrian Interaction Modeling in Autonomous Driving

Guangxun Zhu, Shiyu Fan, Hang Dai, Edmond S. L. Ho

机构 * University of Glasgow(格拉斯哥大学) Wuhan University(武汉大学)

专题命中 数据集与评测 :action model(title);分类 cs.CV

Comments ACM Multimedia 2025 (Dataset Track) Paper

详情

展开后加载摘要…

URL PDF HTML 收藏