arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-12-16 至 2025-12-16 共收录 7 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 6 篇

2512.11865 2025-12-16 cs.CV cs.AI cs.RO 89%

Explainable Adversarial-Robust Vision-Language-Action Model for Robotic Manipulation

可解释的对抗鲁棒视觉-语言-动作模型用于机器人操作

Ju-Young Kim, Ji-Hong Park, Myeongjun Kim, Gun-Woo Kim

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Department of AI Convergence Engineering(人工智能融合工程系) Gyeongsang National University(庆尚国立大学)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title,abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 本文提出了一种可解释的对抗鲁棒视觉-语言-动作模型,用于提升机器人操作在对抗攻击下的动作预测精度和可解释性。

Comments Accepted to MobieSec 2025 (poster session)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11047 2025-12-16 cs.RO cs.AI cs.CV 85%

WholeBodyVLA: Towards Unified Latent VLA for Whole-Body Loco-Manipulation Control

WholeBodyVLA: 向统一的潜变量VLA迈进以实现全身体姿操控控制

Haoran Jiang, Jin Chen, Qingwen Bu, Li Chen, Modi Shi, Yanjie Zhang, Delong Li, Chuanzhe Suo, Chuang Wang, Zhihui Peng, Hongyang Li

机构 * Fudan University(复旦大学) OpenDriveLab & MMLab at The University of Hong Kong(香港大学开放驾驶实验室及多模态实验室) AgiBot(AgiBot公司) SII(SII研究所)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 WholeBodyVLA通过统一的潜变量学习框架和专门设计的强化学习策略,实现了大空间人形运动-操控的精准控制与高效泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00139 2025-12-16 cs.RO cs.AI 84%

End-to-End Dexterous Arm-Hand VLA Policies via Shared Autonomy: VR Teleoperation Augmented by Autonomous Hand VLA Policy for Efficient Data Collection

端到端的灵活臂-手VLA策略通过共享自主性:通过自主手VLA策略增强的VR远程操作用于高效数据收集

Yu Cui, Yujian Zhang, Lina Tao, Yang Li, Xinyu Yi, Zhibin Li

机构 * ByteDance(字节跳动)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种共享自主框架,通过结合VR远程操作和自主手VLA策略,实现高效的数据收集,从而训练端到端的VLA策略以提升机器人灵活操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13080 2025-12-16 cs.RO 83%

Spatial-Aware VLA Pretraining through Visual-Physical Alignment from Human Videos

通过人类视频中的视觉-物理对齐实现空间感知的VLA预训练

Yicheng Feng, Wanpeng Zhang, Ye Wang, Hao Luo, Haoqi Yuan, Sipeng Zheng, Zongqing Lu

机构 * Peking University(北京大学) Renmin University of China(中国人民大学) BeingBeyond

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO

AI总结 通过人类视频中的视觉-物理对齐实现空间感知的VLA预训练,提升机器人任务的稳健性和通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13382 2025-12-16 astro-ph.GA 78%

ALMA view on the nature of the compact VLA continuum sources in the massive young stellar object G25.65+1.05

ALMA对巨星级年轻恒星源G25.65+1.05中紧凑VLA连续源性质的观测

N. N. Shakhvorostova, A. M. Sobolev, D. A. Ladeyshchikov, S. Y. Parfenov, A. A. Shagabutdinov, S. -Y. Liu

专题命中 VLA模型 :VLA(title,abstract)

AI总结 ALMA观测揭示G25.65+1.05中紧凑VLA源的性质,发现其与H2O微波放大超爆发的关联。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13048 2025-12-16 astro-ph.GA 71%

A New Catalog of Head Tail Radio Galaxies from the VLA FIRST Survey

从VLA FIRST调查中发现新的头尾射电星系目录

Tapan K. Sasmal, Soumen Bera, Sabyasachi Pal, Soumen Mondal

专题命中 VLA模型 :VLA(title)

AI总结 本文通过VLA FIRST调查发现了717个新的头尾射电星系,其中包含287个窄角尾和430个宽角尾,研究了它们的物理性质和统计特征。

Comments Published in APJS

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 部署与泛化 1 篇

2512.11921 2025-12-16 cs.RO cs.AI 84%

Towards Accessible Physical AI: LoRA-Based Fine-Tuning of VLA Models for Real-World Robot Control

迈向可及的物理AI:基于LoRA的VLA模型在现实机器人控制中的微调

Abdullah Yahya Abdullah Omaisan, Ibrahim Sheikh Mohamed

机构 * Independent Researchers(独立研究者)

专题命中 部署与泛化 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于LoRA的VLA模型微调方法,使大规模VLA模型能在消费级GPU上高效运行,实现在低成本机器人平台上的现实部署。

详情

展开后加载摘要…

URL PDF HTML 收藏