arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-12-22 至 2025-12-22 共收录 7 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2512.15411 2025-12-22 cs.RO cs.CV 90%

MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training

MiVLA:迈向具有人机互模仿预训练的通用视觉-语言-动作模型

Zhenhan Yin, Xuanhan Wang, Jiahao Jiang, Kaiyuan Deng, Pengqi Chen, Shuangle Li, Chong Liu, Xing Xu, Jingkuan Song, Lianli Gao, Heng Tao Shen

机构 * Tongji University(同济大学) University of Electronic Science and Technology of China(电子科技大学)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);VLA(abstract);分类 cs.RO、cs.CV

AI总结 MiVLA通过人机互模仿预训练,提升视觉-语言-动作模型在现实与模拟环境中的泛化能力,实验显示其在模拟和现实任务中均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15258 2025-12-22 cs.RO cs.AI 88%

VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments

VLA-AN:一种用于复杂环境空中导航的高效且机载视觉-语言-动作框架

Yuze Wu, Mo Zhu, Xingxing Li, Yuheng Du, Yuxin Fan, Wenjun Li, Zhichao Han, Xin Zhou, Fei Gao

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);分类 cs.RO、cs.AI

AI总结 VLA-AN通过高效机载框架提升无人机在复杂环境中的导航能力,实现8.3倍推理吞吐量提升和98.1%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11362 2025-12-22 cs.RO 88%

An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges

视觉-语言-动作模型的解剖:从模块到里程碑与挑战

Chao Xu, Suyu Zhang, Yang Liu, Baigui Sun, Weihong Chen, Bo Xu, Qi Liu, Juncheng Wang, Shujun Wang, Shan Luo, Jan Peters, Athanasios V. Vasilakos, Stefanos Zafeiriou, Jiankang Deng

机构 * IROOTECH TECHNOLOGY(IROOTECH技术公司) Wolf 1069 b Lab, Sany Group(Sany集团沃尔夫1069b实验室) Department of Engineering, King’s College London(伦敦国王学院工程系) Hong Kong Polytechnic University(香港理工大学) Computer Science Department of the Technische Universität Darmstadt(德累斯顿技术大学计算机科学系) Department of ICT and Center for AI Research, University of Agder (UiA)(阿格德大学信息与通信技术系及人工智能研究中心) Department of Computing, Imperial College London(伦敦帝国理工学院计算系)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,comments);分类 cs.RO

AI总结 本文系统分析了视觉-语言-动作模型的核心挑战,从模块构建到里程碑发展,为研究者提供结构化指南和未来研究方向。

Comments project page: https://suyuz1.github.io/VLA-Survey-Anatomy/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15692 2025-12-22 cs.RO cs.AI cs.CV cs.LG 87%

mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs

mimic-video: 用于超越VLAs的通用机器人控制的视频-动作模型

Jonas Pai, Liam Achenbach, Victoriano Montesinos, Benedek Forrai, Oier Mees, Elvis Nava

机构 * mimic robotics Microsoft Zurich(微软瑞士分公司) ETH Zurich(苏黎世联邦理工学院) ETH AI Center(苏黎世联邦理工学院人工智能中心) UC Berkeley(伯克利大学)

专题命中 VLA模型 :action model(title,abstract);vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 mimic-video通过结合预训练的视频模型和基于流匹配的动作解码器,实现了更有效的机器人控制,提升了样本效率和收敛速度。

Comments Revised Introduction, Related Work, and Appendix. Additional minor notational and grammatical fixes

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10008 2025-12-22 cs.RO cs.AI 84%

Phantom Menace: Exploring and Enhancing the Robustness of VLA Models Against Physical Sensor Attacks

幻影威胁:探索和增强VLA模型对物理传感器攻击的鲁棒性

Xuancun Lu, Jiaxiang Chen, Shilin Xiao, Zizhi Jin, Zhangrui Chen, Hanwen Yu, Bohan Qian, Ruochen Zhou, Xiaoyu Ji, Wenyuan Xu

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种新型框架,用于研究和增强VLA模型对物理传感器攻击的鲁棒性,并开发了对抗训练方法以提升模型安全性。

Comments Accepted by AAAI 2026 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17698 2025-12-22 astro-ph.SR astro-ph.GA 78%

A VLA search for compact radio sources in the explosive molecular outflows DR 21 and G5.89

在爆炸性分子喷流DR 21和G5.89中寻找紧凑射电源的VLA搜索

Vanessa Yanza, Sergio A. Dzib, Aina Palau, William J. Henney, Luis F. Rodríguez, Luis A. Zapata

专题命中 VLA模型 :VLA(title,abstract)

AI总结 通过VLA观测DR 21和G5.89的紧凑射电源,发现这些源可能与爆炸性分子喷流有关,并通过电离弧形结构追踪电离源的起源。

Comments 17 pages,11 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05631 2025-12-22 hep-ph astro-ph.CO 71%

Cosmic Structure Strikes Back: The Elimination of Vector-Mediated Nonstandard Interaction Models as a Mechanism for Sterile Neutrino Dark Matter Production

宇宙结构反扑:通过新玻色子介导的非标准相互作用模型消除作为惰性中微子暗物质生产的机制

Cannon M. Vogel, Helena García Escudero, Kevork N. Abazajian

专题命中 VLA模型 :action model(title)

AI总结 通过新玻色子介导的非标准相互作用模型被排除,而标量介导模型和低温重加热模型仍可行。

Comments 8 pages, 3 figures; v2: matches published version

Journal ref Phys. Rev. D 112 (2025) 12, 123022

详情

展开后加载摘要…

URL PDF HTML 收藏