arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-09-26 至 2025-09-26 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 1 篇

2507.23682 2025-09-26 cs.RO cs.AI cs.LG 90%

villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models

Xiaoyu Chen, Hangxing Wei, Pushi Zhang, Chuheng Zhang, Kaixin Wang, Yanjiang Guo, Rushuai Yang, Yucen Wang, Xinquan Xiao, Li Zhao, Jianyu Chen, Jiang Bian

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Project page: https://aka.ms/villa-x

详情

展开后加载摘要…

URL PDF HTML 收藏