arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-09-18 至 2025-09-18 共收录 6 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 5 篇

2509.11417 2025-09-18 cs.RO cs.AI cs.CV cs.LG 90%

Enhancing Generalization in Vision-Language-Action Models by Preserving Pretrained Representations

Shresth Grover, Akshay Gopalkrishnan, Bo Ai, Henrik I. Christensen, Hao Su, Xuanlin Li

机构 * UC San Diego(圣迭戈大学) Hillbot

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,comments);分类 cs.RO、cs.CV、cs.AI

Comments Project Page: https://gen-vla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14138 2025-09-18 cs.RO 88%

SeqVLA: Sequential Task Execution for Long-Horizon Manipulation with Completion-Aware Vision-Language-Action Model

Ran Yang, Zijian An, Lifeng ZHou, Yiming Feng

机构 * Virginia Seafood Agricultural Research and Extension Center, and Department of Biological Systems Engineering, Virginia Tech(弗吉尼亚海产品农业研究中心及生物系统工程系,弗吉尼亚理工学院) Department of Electrical and Computer Engineering, Drexel University(电气与计算机工程系,德雷塞尔大学)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO

Comments 8 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13774 2025-09-18 cs.RO 83%

Dual-Actor Fine-Tuning of VLA Models: A Talk-and-Tweak Human-in-the-Loop Approach

Piaopiao Jin, Qi Wang, Guokang Sun, Ziwen Cai, Pinjia He, Yangwei You

机构 * Beijing Xiaomi Robot Technology Co., Ltd.(北京小米机器人科技有限公司) City University of Hong Kong(香港城市大学)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13769 2025-09-18 cs.CV 70%

AdaThinkDrive: Adaptive Thinking via Reinforcement Learning for Autonomous Driving

Yuechen Luo, Fang Li, Shaoqing Xu, Zhiyi Lai, Lei Yang, Qimao Chen, Ziang Luo, Zixun Xie, Shengyin Jiang, Jiaxin Liu, Long Chen, Bing Wang, Zhi-xin Yang

机构 * Tsinghua University(清华大学) Xiaomi EV(小米电动车) University of Macau(澳门大学) Nanyang Technological University(南洋理工大学) Peking University(北京大学)

专题命中 VLA模型 :vision language action(abstract);VLA(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13347 2025-09-18 cs.AI 70%

OpenHA: A Series of Open-Source Hierarchical Agentic Models in Minecraft

Zihao Wang, Muyao Li, Kaichen He, Xiangyu Wang, Zhancun Mu, Anji Liu, Yitao Liang

机构 * Peking University(北京大学) National University of Singapore(新加坡国立大学)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 语言条件控制 1 篇

2405.19988 2025-09-18 cs.RO cs.AI cs.CL cs.CV cs.LG 79%

Video-Language Critic: Transferable Reward Functions for Language-Conditioned Robotics

Minttu Alakuijala, Reginald McLean, Isaac Woungang, Nariman Farsad, Samuel Kaski, Pekka Marttinen, Kai Yuan

机构 * Department of Computer Science, Aalto University(艾尔沃斯大学计算机科学系) Department of Computer Science, Toronto Metropolitan University(多伦多 Metropolitan 大学计算机科学系) Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) Intel Corporation(英特尔公司)

专题命中 语言条件控制 :language-conditioned robot(title);分类 cs.RO、cs.CV、cs.AI

Comments 14 pages in the main text, 22 pages including references and supplementary materials. 3 figures and 3 tables in the main text, 6 figures and 3 tables in supplementary materials

Journal ref Transactions on Machine Learning Research (TMLR) (02/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏