arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-11-13 至 2025-11-13 共收录 6 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2511.09516 2025-11-13 cs.RO cs.CV 92%

MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation

Runhao Li, Wenkai Guo, Zhenyu Wu, Changyuan Wang, Haoyuan Deng, Zhenyu Weng, Yap-Peng Tan, Ziwei Wang

机构 * Nanyang Technological University(南洋理工大学) VinUniversity(文大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) South China University of Technology(华南理工大学)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);action model(title,abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15201 2025-11-13 cs.RO cs.AI 90%

Survey of Vision-Language-Action Models for Embodied Manipulation

Haoran Li, Yuhui Chen, Wenbo Cui, Weiheng Liu, Kai Liu, Mingcai Zhou, Zhengtao Zhang, Dongbin Zhao

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.RO、cs.AI

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09515 2025-11-13 cs.RO cs.AI 88%

WMPO: World Model-based Policy Optimization for Vision-Language-Action Models

Fangqi Zhu, Zhengyang Yan, Zicong Hong, Quanxin Shou, Xiao Ma, Song Guo

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ByteDance Seed(字节跳动种子)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO、cs.AI

Comments project website: https://wm-po.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15691 2025-11-13 cs.LG cs.AI 81%

What Do Latent Action Models Actually Learn?

Chuheng Zhang, Tim Pearce, Pushi Zhang, Kaixin Wang, Xiaoyu Chen, Wei Shen, Li Zhao, Jiang Bian

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 VLA模型 :action model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13397 2025-11-13 cs.CV 79%

Trustworthy Pedestrian Trajectory Prediction via Pattern-Aware Interaction Modeling

Kaiyuan Zhai, Juan Chen, Chao Wang, Zeyi Xu, Guoming Tang

机构 * Shanghai University(上海大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 VLA模型 :action model(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08865 2025-11-13 cs.RO cs.HC 70%

MirrorLimb: Implementing hand pose acquisition and robot teleoperation based on RealMirror

Cong Tai, Hansheng Wu, Haixu Long, Zhengbin Long, Zhaoyu Zheng, Haodong Xiang, Tao Shen

机构 * ZTE Terminators Group(ZTE终止者集团)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏