arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-11-19 至 2025-11-19 共收录 7 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2506.01196 2025-11-19 cs.RO cs.AI cs.CV 90%

OG-VLA: Orthographic Image Generation for 3D-Aware Vision-Language Action Model

Ishika Singh, Ankit Goyal, Stan Birchfield, Dieter Fox, Animesh Garg, Valts Blukis

机构 * University of Southern California(美国南加州大学) NVIDIA(英伟达)

专题命中 VLA模型 :VLA(title,abstract);action model(title,abstract);vision language action(abstract);分类 cs.RO、cs.CV、cs.AI

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14659 2025-11-19 cs.RO cs.AI 87%

NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards

Chia-Yu Hung, Navonil Majumder, Haoyuan Deng, Liu Renhang, Yankang Ang, Amir Zadeh, Chuan Li, Dorien Herremans, Ziwei Wang, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Lambda Labs(Lambda实验室) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 VLA模型 :vision-language-action(title);action model(title);VLA(abstract);分类 cs.RO、cs.AI

Comments https://declare-lab.github.io/nora-1.5

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22242 2025-11-19 cs.CV 86%

4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration

Jiahui Zhang, Yurui Chen, Yueming Xu, Ze Huang, Yanpeng Zhou, Yu-Jie Yuan, Xinyue Cai, Guowei Huang, Xingyue Quan, Hang Xu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04055 2025-11-19 q-bio.QM cs.AI cs.LG 81%

Benchmark on Drug Target Interaction Modeling from a Drug Structure Perspective

Xinnan Zhang, Jialin Wu, Junyi Xie, Tianlong Chen, Kaixiong Zhou

机构 * University of Minnesota(明尼苏达大学) University of California San Diego(加州大学圣地亚哥分校) UNC Chapel Hill(北卡罗来纳大学教堂山分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 VLA模型 :action model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14499 2025-11-19 cs.CV cs.RO 73%

Enhancing End-to-End Autonomous Driving with Risk Semantic Distillaion from VLM

Jack Qin, Zhitao Wang, Yinan Zheng, Keyu Chen, Yang Zhou, Yuanxin Zhong, Siyuan Cheng

机构 * Tsinghua University(清华大学) Laboratories, Huawei Technologies(华为技术有限公司2012实验室)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12585 2025-11-19 physics.soc-ph cond-mat.stat-mech nlin.AO 50%

The Impact of Social Attractiveness on Casual Group Formation: Power-Law Group Sizes and Suppressed Percolation

Matheus S. Mariano, José F. Fontanari

专题命中 VLA模型 :action model(abstract)

Journal ref J. Stat. Mech. (2025) 113405

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14089 2025-11-19 gr-qc astro-ph.CO hep-th 50%

Cosmological dynamics of interacting dark matter-dark energy in generalized Rastall gravity

Manuel Gonzalez-Espinoza, Ramón Herrera, Giovanni Otalora, Carlos Ríos, Carlos Rodriguez-Benites

专题命中 VLA模型 :action model(abstract)

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏