arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-10-16 至 2025-10-16 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 数据集与评测 2 篇

2510.13149 2025-10-16 cs.RO 57%

RoboHiMan: A Hierarchical Evaluation Paradigm for Compositional Generalization in Long-Horizon Manipulation

Yangtao Chen, Zixuan Chen, Nga Teng Chan, Junting Chen, Junhui Yin, Jieqi Shi, Yang Gao, Yong-Lu Li, Jing Huo

机构 * Nanjing University(南京大学) The Hong Kong University of Science and Technology(香港科技大学) National University of Singapore(新加坡国立大学) Shanghai Jiaotong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 数据集与评测 :VLA(abstract);分类 cs.RO

Comments Under review. These first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10414 2025-10-16 cs.CV 57%

HUMOTO: A 4D Dataset of Mocap Human Object Interactions

Jiaxin Lu, Chun-Hao Paul Huang, Uttaran Bhattacharya, Qixing Huang, Yi Zhou

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Adobe Research(Adobe研究院)

专题命中 数据集与评测 :action model(abstract);分类 cs.CV

Comments ICCV 2025, 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏