arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-10-15 至 2025-10-15 共收录 12 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 9 篇

2510.10975 2025-10-15 cs.RO 88%

RoVer: Robot Reward Model as Test-Time Verifier for Vision-Language-Action Model

Mingtong Dai, Lingbo Liu, Yongjie Bai, Yang Liu, Zhouxia Wang, Rui SU, Chunjie Chen, Liang Lin, Xinyu Wu

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Peng Cheng Laboratory(鹏城实验室) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Shanghai AI Laboratory(上海人工智能实验室) University of Chinese Academy of Sciences(中国科学院大学) X-Era AI Lab(X-Era人工智能实验室)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16845 2025-10-15 cs.CV cs.AI cs.LG 85%

NinA: Normalizing Flows in Action. Training VLA Models with Normalizing Flows

Denis Tarasov, Alexander Nikulin, Ilya Zisman, Albina Klepach, Nikita Lyubaykin, Andrei Polubarov, Alexander Derevyagin, Vladislav Kurenkov

机构 * ETH Zürich(苏黎世联邦理工学院) MIPT(莫斯科国立信息安全大学) Skoltech(斯克里普斯基技术大学) Innopolis University(因诺波利斯大学) HSE(俄罗斯高等经济学院)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.CV、cs.AI、cs.LG

Comments https://github.com/dunnolab/NinA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10845 2025-10-15 cs.CV 83%

CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving

Hidehisa Arai, Keita Miwa, Kento Sasaki, Yu Yamaguchi, Kohei Watanabe, Shunsuke Aoki, Issei Yamamoto

机构 * Turing Inc.(图灵公司)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract);分类 cs.CV

Comments WACV 2025, Project Page: https://turingmotors.github.io/covla-ad/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07105 2025-10-15 astro-ph.GA 78%

Probing the Infrared/Radio correlation of the full IRAS Revised Bright Galaxy Sample with MeerKAT and the VLA

M. E. Moloko, L. Marchetti, T. H. Jarrett, J. J. Condon, W. D. Cotton, A. M. Matthews, T. Mauch, M. Vaccari

专题命中 VLA模型 :VLA(title,abstract)

Comments This manuscript is 26 pages long and contains 16 figures and 3 tables. The data are provided in machine-readable format on Zenodo at https://doi.org/10.5281/zenodo.16889781. The paper was accepted for publication in the Monthly Notices of the Royal Astronomical Society Main Journal on 26 August 2025, ref. MN-24-1207-MJ.R3

Journal ref Mon Not R Astron Soc (2025) 2463-2488

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11660 2025-10-15 cs.RO cs.AI 73%

ManiAgent: An Agentic Framework for General Robotic Manipulation

Yi Yang, Kefan Gu, Yuqing Wen, Hebei Li, Yucheng Zhao, Tiancai Wang, Xudong Liu

机构 * Beijing University of Technology(北京理工大学) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) Dexmal

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.AI

Comments 8 pages, 6 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07961 2025-10-15 cs.RO cs.AI 73%

BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models

Peiyan Li, Yixiang Chen, Hongtao Wu, Xiao Ma, Xiangnan Wu, Yan Huang, Liang Wang, Tao Kong, Tieniu Tan

机构 * CASIA(中国科学院自动化研究所) ByteDance Seed(字节跳动种子实验室) UCAS(中国科学院大学) FiveAges NJU(南京大学)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.AI

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16815 2025-10-15 cs.CV cs.RO 62%

Image Quality Assessment for Embodied AI

Chunyi Li, Jiaohao Xiao, Jianbo Zhang, Farong Wen, Zicheng Zhang, Yuan Tian, Xiangyang Zhu, Xiaohong Liu, Zhengxue Cheng, Weisi Lin, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Lab(上海人工智能实验室) Nanyang Technological University(南洋理工大学)

专题命中 VLA模型 :vision language action(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12645 2025-10-15 astro-ph.GA 50%

Searching for Stellar-Feedback-Driven Outflow Signatures: A Deep Dive into NGC 3741

Lexi N. Gault, Liese van Zee, Elizabeth A. K. Adams, James M. Wells, Laura Congreve Hunter, Kristen B. W. McQuinn, Roger E. Cohen, O. Grace Telford

专题命中 VLA模型 :VLA(abstract)

Comments 18 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06681 2025-10-15 nucl-ex nucl-th 50%

Probing the cluster structure of $^6$Li with the nuclear reaction $^6$Li + $^{12}$C at 68 MeV

B. A. Urazbekov, E. K. Almanbetova, A. Azhibekov, B. S. Baimurzinova, K. Dyussebayeva, T. Issatayev, D. M. Janseitov, S. M. Lukyanov, Yu. E. Penionzhkevich, K. Mendibayev, T. K. Zholdybayev

专题命中 VLA模型 :action model(abstract)

Comments 17 pages, 12 figures, 2 tables. Accepted for publication in Chinese Physics C

Journal ref Chin. Phys. C 50 (2026) 014102

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 2 篇

2510.12483 2025-10-15 cs.RO cs.CV 62%

Fast Visuomotor Policy for Robotic Manipulation

Jingkai Jia, Tong Yang, Xueyao Chen, Chenhuan Liu, Wenqiang Zhang

机构 * Fudan University(复旦大学) MEGVII Technology(MEGVII科技)

专题命中 动作表示与策略 :action model(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12771 2025-10-15 quant-ph 50%

Trajectory-Protected Quantum Computing

Barbara Šoda, Pierre-Antoine Graham, T. Rick Perche, Gurpahul Singh

专题命中 动作表示与策略 :action model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 部署与泛化 1 篇

2408.02377 2025-10-15 cs.CL cs.AI 57%

A Few-Shot Approach for Relation Extraction Domain Adaptation using Large Language Models

Vanni Zavarella, Juan Carlos Gamero-Salinas, Sergio Consoli

机构 * Department of Mathematics and Computer Science, University of Cagliari, Cagliari, Italy(数学与计算机科学系,卡利亚里大学,卡利亚里,意大利) Institute of Data Science and Artificial Intelligence (DATAI), Universidad de Navarra, Pamplona, Spain(数据科学与人工智能研究所(DATAI),纳瓦拉大学,潘普隆,西班牙) European Commission, Joint Research Centre (DG JRC), Ispra (VA), Italy(欧洲委员会,联合研究中心(DG JRC),伊斯普拉(瓦拉),意大利)

专题命中 部署与泛化 :action model(abstract);分类 cs.AI

Journal ref CEUR Workshop Proceedings, Vol. 3894 (2024), Workshop at KDD 2024 on Deep Learning and Large Language Models for Knowledge Graphs

详情

展开后加载摘要…

URL PDF HTML 收藏