arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-10-14 至 2025-10-14 共收录 8 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 5 篇

2510.10274 2025-10-14 cs.RO cs.AI cs.CV 91%

X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model

Jinliang Zheng, Jianxiong Li, Zhihao Wang, Dongxiu Liu, Xirui Kang, Yuchun Feng, Yinan Zheng, Jiayin Zou, Yilun Chen, Jia Zeng, Ya-Qin Zhang, Jiangmiao Pang, Jingjing Liu, Tai Wang, Xianyuan Zhan

机构 * Institute for AI Industry Research (AIR) Tsinghua University(人工智能产业研究院(AIR)清华大学) Shanghai AI Lab(上海人工智能实验室) Peking University(北京大学)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);action model(title);分类 cs.RO、cs.CV、cs.AI

Comments preprint, technical report, 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01424 2025-10-14 cs.RO 88%

TriVLA: A Triple-System-Based Unified Vision-Language-Action Model with Episodic World Modeling for General Robot Control

Zhenyang Liu, Yongchong Gu, Sixiao Zheng, Yanwei Fu, Xiangyang Xue, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11262 2025-10-14 nucl-th 50%

TENDL-astro: a new nuclear data set for astrophysics interest

D. Rochman, A. Koning, S. Goriely, S. Hilaire

专题命中 VLA模型 :action model(abstract)

Comments 21 pages

Journal ref Nucl. Phys. A 1053 (2025) 122951

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12284 2025-10-14 gr-qc 50%

New HDE models with higher derivatives of the Hubble parameter $H$

Antonio Pasqua

专题命中 VLA模型 :action model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15928 2025-10-14 astro-ph.HE 50%

A Late-time Radio Search for Highly Off-axis Jets from PTF Broad-lined Ic Supernovae in GRB-like Host Galaxy Environments

Genevieve Schroeder, Anna Y. Q. Ho, Ranadeep G. Dastidar, Maryam Modjaz, Alessandra Corsi, Paul C. Duffell

专题命中 VLA模型 :VLA(abstract)

Comments 20 pages, 8 figures, accepted

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 1 篇

2510.09667 2025-10-14 cs.CV cs.RO 73%

OmniSAT: Compact Action Token, Faster Auto Regression

Huaihai Lyu, Chaofan Chen, Senwei Xie, Pengwei Wang, Xiansheng Chen, Shanghang Zhang, Changsheng Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Institute of Computation, Chinese Academy of Sciences(中国科学院计算研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Peking University(北京大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 动作表示与策略 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 数据集与评测 2 篇

2510.11509 2025-10-14 cs.CV 57%

Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model

Ruiping Liu, Junwei Zheng, Yufan Chen, Zirui Wang, Kunyu Peng, Kailun Yang, Jiaming Zhang, Marc Pollefeys, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院) Hunan University(湖南大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 数据集与评测 :action model(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025 Datasets and Benchmarks Track. Dataset and Code: https://github.com/RuipingL/Situat3DChange

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20036 2025-10-14 cs.SE cs.AI 57%

Agents in the Sandbox: End-to-End Crash Bug Reproduction for Minecraft

Eray Yapağcı, Yavuz Alp Sencer Öztürk, Eray Tüzün

机构 * Electronics Engineering Department Bilkent University Ankara, Turkey(电子工程系比尔肯特大学安卡拉土耳其) Computer Engineering Department Bilkent University Ankara, Turkey(计算机工程系比尔肯特大学安卡拉土耳其)

专题命中 数据集与评测 :action model(abstract);分类 cs.AI

Comments Accepted into ASE'25 (Automated Software Engineering). https://conf.researchr.org/details/ase-2025/ase-2025-papers/244/Agents-in-the-Sandbox-End-to-End-Crash-Bug-Reproduction-for-Minecraft

详情

展开后加载摘要…

URL PDF HTML 收藏