arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-19 至 2025-12-19 共收录 51 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 20 篇

2512.16724 2025-12-19 cs.RO cs.CV 88%

VERM: Leveraging Foundation Models to Create a Virtual Eye for Efficient 3D Robotic Manipulation

VERM:利用基础模型创建虚拟眼睛以实现高效的3D机器人操作

Yixiang Chen, Yan Huang, Keji He, Peiyan Li, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别新技术实验室,多模态人工智能系统国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) FiveAges Shandong University(山东大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 VERM通过利用基础模型创建虚拟视图,提升3D机器人操作的效率和准确性,实现训练和推理速度的显著提升。

Comments Accepted at RA-L 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16023 2025-12-19 cs.CV 86%

CoVAR: Co-generation of Video and Action for Robotic Manipulation via Multi-Modal Diffusion

CoVAR: 通过多模态扩散生成视频与动作用于机器人操作

Liudi Yang, Yang Bai, George Eskandar, Fengyi Shen, Mohammad Altillawi, Dong Chen, Ziyuan Liu, Abhinav Valada

机构 * University of Freiburg(弗赖堡大学) Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Technical University of Munich(慕尼黑技术大学) Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心)

专题命中 机器人操作 :robotic(title,abstract);manipulation(title);分类 cs.CV

AI总结 CoVAR通过多模态扩散模型生成视频与动作,解决机器人操作中动作标注不足的问题,提升视频生成质量与动作精度。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01218 2025-12-19 cs.RO cs.AI cs.CV cs.LG 85%

Provable Ordering and Continuity in Vision-Language Pretraining for Generalizable Embodied Agents

可证明的视觉-语言排序与连续性在通用化具身体验代理中的预训练

Zhizhen Zhang, Lei Zhu, Zhen Fang, Zi Huang, Yadan Luo

机构 * The University of Queensland(昆士兰大学) Tongji University(同济大学) University of Technology Sydney(悉尼科技大学)

专题命中 机器人操作 :embodied agent(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出AcTOL方法,通过对比帧间语义差异和局部布朗桥约束,实现有序且连续的视觉-语言表示,提升具身体验代理在不同指令风格下的鲁棒性。

Comments NeurIPS 2025 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17466 2025-12-19 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 84%

Optimizing Grasping in Legged Robots: A Deep Learning Approach to Loco-Manipulation

为四足机器人优化抓取:一种深度学习的移动-操作方法

Dilermando Almeida, Guilherme Lazzarini, Juliano Negri, Thiago H. Segreto, Ricardo V. Godoy, Marcelo Becker

机构 * College of Mechanical Engineering, Federal University of Uberlândia(联邦大学伯南迪亚学院机械工程学院) Department of Mechanical Engineering, University of São Paulo(圣保罗大学机械工程系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV;robotics(journal_ref)

AI总结 本文提出一种深度学习方法,通过模拟训练提升四足机器人抓取精度和适应性,实现自主导航与精准抓取。

Journal ref 2025 Latin American Robotics Symposium (LARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14994 2025-12-19 cs.RO cs.CV cs.LG cs.SY eess.SY 83%

A Vision-Based Shared-Control Teleoperation Scheme for Controlling the Robotic Arm of a Four-Legged Robot

基于视觉的共享控制远程操作方案用于控制四足机器人的机械臂

Murilo Vinicius da Silva, Matheus Hipolito Carvalho, Juliano Negri, Thiago Segreto, Gustavo J. G. Lahr, Ricardo V. Godoy, Marcelo Becker

机构 * Department of Mechanical Engineering, University of São Paulo(机械工程系,圣保罗大学) Instituto Israelita de Ensino e Pesquisa Albert Einstein, Hospital Israelita Albert Einstein(艾利哈德研究所,以色列医院)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.CV、cs.LG;robotics(journal_ref)

AI总结 本文提出了一种基于视觉的姿态估计方法,通过检测操作员手腕位置来实现四足机器人机械臂的直观远程控制,提高了安全性和易用性。

Journal ref 2025 Latin American Robotics Symposium (LARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16103 2025-12-19 cs.LG cs.AI 81%

AIMM: An AI-Driven Multimodal Framework for Detecting Social-Media-Influenced Stock Market Manipulation

AIMM:一种基于人工智能的多模态框架,用于检测受社交媒体影响的股市操纵

Sandeep Neela

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI、cs.LG

AI总结 AIMM通过融合社交媒体和市场数据,提出了一种人工智能驱动的多模态框架,用于检测社交媒体影响的股市操纵,并展示了其在GME事件中的早期预警能力。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16449 2025-12-19 cs.RO 79%

Single-View Shape Completion for Robotic Grasping in Clutter

单视角形状补全用于机器人抓取中的杂乱环境

Abhishek Kashyap, Yuxuan Yang, Henrik Andreasson, Todor Stoyanov

机构 * Örebro University(奥雷布罗大学)

专题命中 机器人操作 :robotic(title);manipulation(abstract);分类 cs.RO

AI总结 本研究利用扩散模型实现单视角下杂乱环境中物体的3D形状补全,提升机器人抓取成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16302 2025-12-19 cs.RO 79%

ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation

ManiLong-Shot:交互感知的一次学习方法用于长周期操控

Zixuan Chen, Chongkai Gao, Lin Shao, Jieqi Shi, Jing Huo, Yang Gao

机构 * National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 ManiLong-Shot通过交互感知原语分解实现长周期操控任务的一次学习,有效提升机器人任务执行能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16842 2025-12-19 cs.CV cs.AI cs.RO 75%

OPENTOUCH: Bringing Full-Hand Touch to Real-World Interaction

OPENTOUCH:将全手触觉带入现实世界交互

Yuxin Ray Song, Jinzhou Li, Rao Fu, Devin Murphy, Kaichen Zhou, Rishi Shiv, Yaqi Li, Haoyu Xiong, Crystal Elaine Owens, Yilun Du, Yiyue Luo, Xianyi Cheng, Antonio Torralba, Wojciech Matusik, Paul Pu Liang

机构 * MIT(麻省理工学院) Duke University(杜克大学) Brown University(布朗大学) University of Washington(华盛顿大学) Harvard University(哈佛大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 OpenTouch是首个现实场景的第一人称全手触觉数据集,通过同步视频-触觉-姿态数据和详细注释,推动多模态感知和机器人操作研究。

Comments https://opentouch-tactile.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16194 2025-12-19 cond-mat.str-el 71%

Atomic-scale control of substrate-spin coupling via vertical manipulation of a 2D metal-organic framework

二维金属有机框架中基底-自旋耦合的原子尺度控制 via 垂直操控

Benjamin Lowe, Bernard Field, Dhaneesh Kumar, Daniel Moreno Cerrada, Oleksandr Stetsovych, Julian Ceddia, Andrés Pinar Solé, Amelia Domínguez-Celorrio, Jack Hellerstedt, Sinéad M. Griffin, Pavel Jelínek, Agustin Schiffrin

专题命中 机器人操作 :manipulation(title)

AI总结 通过垂直操控二维 Mott 绝缘体 kagome 金属有机框架,实现了对基底-自旋耦合的原子尺度控制,展示了 Kondo 耦合强度的可调性。

Comments 16 pages, 6 figures, and SI 3 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16896 2025-12-19 cs.RO cs.CV cs.GR 62%

Sceniris: A Fast Procedural Scene Generation Framework

Sceniris:一种快速的程序化场景生成框架

Jinghuan Shang, Harsh Patel, Ran Gong, Karl Schmeckpeper

机构 * Robotics and AI Institute(机器人与人工智能研究院) University of Waterloo(滑铁卢大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 Sceniris是一种高效的程序化场景生成框架,通过提升生成速度和场景可行性,用于快速生成大规模无碰撞场景以支持机器人任务。

Comments Code is available at https://github.com/rai-inst/sceniris

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04133 2025-12-19 cs.AI 57%

TRiSM for Agentic AI: A Review of Trust, Risk, and Security Management in LLM-based Agentic Multi-Agent Systems

TRiSM 用于代理 AI:对基于 LLM 的代理多代理系统中信任、风险和安全管理的综述

Shaina Raza, Ranjan Sapkota, Manoj Karkee, Christos Emmanouilidis

机构 * Vector Institute, Toronto, Canada(向量研究所) Cornell University, USA(康奈尔大学) University of Groningen, Netherlands(格罗宁根大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文综述了基于 LLM 的代理多代理系统中信任、风险和安全管理的框架与方法,提出新的评估指标并探讨了安全与隐私增强策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16563 2025-12-19 cond-mat.mes-hall physics.app-ph 50%

Current-Induced Modulation of Spin-Wave Propagation in a Y-Junction via Transverse Spin-Transfer Torque

电流诱导的Y形结构中自旋波传播调制

Lorenzo Gnoatto, Rai M. Menezes, Artim L. Bassant, Rembert A. Duine, Milorad V. Milosevic, Reinoud Lavrijsen

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究通过局部电流注入在Y形Permalloy结构中实现自旋波传播的横向调控,验证了利用自旋转移扭矩控制磁波路由的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15919 2025-12-19 cs.CY cs.CR 50%

Analysing Multidisciplinary Approaches to Fight Large-Scale Digital Influence Operations

分析对抗大规模数字影响操作的多学科方法

David Arroyo, Rafael Mata Milla, Marc Almeida Ros, Nikolaos Lykousas, Ivan Homoliak, Constantinos Patsakis, Fran Casino

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文探讨了利用多学科方法对抗大规模数字影响操作,分析了威胁行为者使用的基础设施、病毒性获利策略及检测与缓解措施。

Comments Accepted in ICISSP20226 (https://icissp.scitevents.org/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16414 2025-12-19 cs.DS 50%

Conquering the Multiverse: The River Voting Method with Efficient Parallel Universe Tiebreaking

征服多元宇宙:具有高效并行宇宙决断的河流投票方法

Jannes Malanowski

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种高效的并行宇宙决断方法,用于解决具有平局的选举问题,改进了River投票方法的计算效率。

Comments This is my Bachelor's Thesis. Based on this thesis we published arXiv:2512.14409

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16308 2025-12-19 physics.optics 50%

Polygonal Spatiotemporal Optical Vortices Wavepackets with Prescribed Vortex Structure

多边形时空光涡波包及其预设涡旋结构

Haifa Fan, Qian Cao, Andy Chong, Qiwen Zhan

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出并实验展示了具有预设涡旋结构的多边形时空光涡波包,通过时空全息成形方法实现对光涡几何和分布的精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16008 2025-12-19 cs.HC 50%

Augmented Reality-Based Smart Structural Health Monitoring System With Accurate 3D Model Alignment

基于增强现实的智能结构健康监测系统与精确的3D模型对齐

Omar Awadallah, Katarina Grolinger, Ayan Sadhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出基于增强现实的结构健康监测系统,通过BIM可视化和3D全息图操作实现精确的3D模型对齐,提升远程协作检查的效率与准确性。

Comments 23 pages, 20 figures. This work is an accepted manuscript published in the Elsevier journal "Journal of Infrastructure Intelligence and Resilience"

Journal ref Journal of Infrastructure Intelligence and Resilience, 5(1), 100186 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15754 2025-12-19 cs.CR cs.NI eess.SP 50%

A Survey on Reconfigurable Intelligent Surfaces in Practical Systems: Security and Privacy Perspectives

面向实际系统的可重构智能表面调研:安全与隐私视角

Ziyu Chen, Yitong Shen, Jingzhe Zhang, Yao Zheng, Yili Ren, Xuyu Wang, Shiwen Mao, Hanqing Guo

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文从安全与隐私视角调研了可重构智能表面在实际系统中的应用,分析了其安全威胁与防御策略,并提供开源工具支持未来研究。

Comments 36 pages, 5 figures, 4 tables. Survey article on security and privacy in RIS-enabled systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15215 2025-12-19 cond-mat.mtrl-sci 50%

Electrically switchable non-relativistic Zeeman spin splittings in collinear antiferromagnets

可用电场切换的非相对论性Zeeman自旋分裂在列状反铁磁体中

Longju Yu, Hong Jian Zhao, Laurent Bellaiche, Yanming Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种理论,揭示列状反铁磁体中可用电场切换的非相对论性Zeeman自旋分裂的机制,并通过计算验证了FeOOH和NaMnP的实验结果。

Comments 7 pages, 3 figures and 2 tables

Journal ref Phys. Rev. Lett. 135, 256704 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01236 2025-12-19 cond-mat.mes-hall cond-mat.mtrl-sci 50%

Artificially built Kondo chains with organic radicals on metallic surfaces: new model system of heavy fermion quantum criticality

人工构建的有机自由基Kondo链在金属表面:重费米量子临界性的新模型系统

En Li, Bimla Danu, Yufeng Liu, Huilin Xie, Jacky Wing Yip Lam, Ben Zhong Tang, Shiyong Wang, Fakher F. Assaad, Nian Lin

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过在金属表面构建有机自由基Kondo链,揭示了重费米量子临界性的新模型系统,利用量子模拟验证了实验结果。

Journal ref J. Am. Chem. Soc. 2025, 147, 50, 46535

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 8 篇

2512.16019 2025-12-19 cs.RO cs.AI 81%

Few-Shot Inference of Human Perceptions of Robot Performance in Social Navigation Scenarios

少样本推理人类对机器人社交导航表现的感知

Qiping Zhang, Nathan Tsoi, Mofeed Nagib, Hao-Tien Lewis Chiang, Marynel Vázquez

机构 * Yale University(耶鲁大学) Google DeepMind(谷歌DeepMind)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出利用大语言模型的少样本学习能力,通过社交导航任务实验,提升机器人预测用户对其表现感知的准确性,验证了方法的可扩展性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16027 2025-12-19 cs.RO 80%

SWIFT-Nav: Stability-Aware Waypoint-Level TD3 with Fuzzy Arbitration for UAV Navigation in Cluttered Environments

SWIFT-Nav:具有模糊仲裁的稳定性感知 waypoint 级 TD3 用于 cluttered 环境中的 UAV 导航

Shuaidong Ji, Mahdi Bamdad, Francisco Cruz

机构 * School of Computer Science and Engineering, University of New South Wales(计算机科学与工程学院,新南威尔士大学) Escuela de Ingeniería, Universidad Central de Chile(工程学院,智利中央大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 SWIFT-Nav 通过结合 TD3、优先回放、校准探索和模糊安全规则,实现 UAV 在 cluttered 环境中的高效可靠导航。

Comments 10 pages, Accepted at Australasian Conference on Robotics and Automation (ACRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16755 2025-12-19 cs.AI 79%

CitySeeker: How Do VLMS Explore Embodied Urban Navigation With Implicit Human Needs?

CitySeeker: VLMS如何通过隐含人类需求探索具身城市导航

Siqi Wang, Chao Liang, Yunfan Gao, Erxin Yu, Sen Li, Yushi Li, Jing Li, Haofen Wang

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Tongji University(同济大学) Nanjing Institute of Geography and Limnology, Chinese Academy of Sciences(中国科学院南京地理与湖泊研究所) Research Centre for Data Science & Artificial Intelligence(数据科学与人工智能研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 CitySeeker通过评估VLMs在动态城市环境中探索具身导航的能力,揭示了隐含需求理解中的关键瓶颈,并提出改进策略以提升空间推理和决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04070 2025-12-19 cs.CL cs.MM 78%

LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower Reward

LaF-GRPO:通过GRPO与LLM-as-Follower生成视障人士的现场导航指令

Yi Zhao, Siqi Wang, Jing Li

专题命中 具身导航 :navigation(title,abstract)

AI总结 LaF-GRPO通过GRPO与LLM-as-Follower生成更直观安全的视障人士现场导航指令,提升指令准确性和实用性。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16555 2025-12-19 cs.RO cs.FL cs.MA cs.SY eess.SY 74%

A Formal Modular Synthesis Approach for the Coordination of 3-D Robotic Construction with Multi-robots

一种用于多机器人3-D建筑协调的正式模块化综合方法

Marcelo Rosa, José E. R. Cury, Fabio L. Baldissera

机构 * Universidade Federal de Santa Catarina(圣卡塔琳娜联邦大学)

专题命中 具身导航 :robotic(title);分类 cs.RO

AI总结 本文提出了一种基于监督控制理论的模块化方法,用于协调多机器人自主构建3-D结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15940 2025-12-19 cs.CV cs.RO 73%

R4: Retrieval-Augmented Reasoning for Vision-Language Models in 4D Spatio-Temporal Space

R4:在4D时空空间中为视觉语言模型引入检索增强推理

Tin Stribor Sohn, Maximilian Dillitzer, Jason J. Corso, Eric Sax

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Esslingen University of Applied Sciences(埃斯林根应用科学大学) Dr. Ing. h.c. F. Porsche AG(德意志联邦汽车工业协会) University of Michigan(密歇根大学) Voxel51 Inc.(Voxel51公司)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO、cs.CV

AI总结 R4通过构建4D时空知识库,使视觉语言模型具备结构化终身记忆,实现无需训练的检索增强推理,提升动态环境中的具身推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18953 2025-12-19 cs.LG 57%

PILA: Physics-Informed Low Rank Augmentation for Interpretable Earth Observation

PILA:基于物理的低秩增强用于可解释的地球观测

Yihang She, Andrew Blake, Clement Atzberger, Adriano Gualandi, Srinivasan Keshav

机构 * Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学) Clare Hall, University of Cambridge(剑桥大学克莱尔学院) Cyclops AI Department of Earth Sciences, University of Cambridge(地球科学系,剑桥大学)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 PILA通过低秩增强方法提升地球观测中物理模型的可解释性和准确性,有效解决不完整物理模型的反演问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20666 2025-12-19 cond-mat.stat-mech math.PR 50%

Evanescent random walker on networks: Hitting times, budget renewal, and survival dynamics

网络上的蒸发随机游走:命中时间、预算更新与生存动态

Thomas M. Michelitsch, Alejandro P. Riascos

专题命中 具身导航 :navigation(abstract)

AI总结 本文研究了网络上具有预算更新机制的随机游走动力学,分析了目标命中统计、生存概率及寿命分布。

Comments 39 pages, 10 figures

Journal ref Chaos 35, 123114 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 3 篇

2512.16461 2025-12-19 cs.CV cs.RO 82%

SNOW: Spatio-Temporal Scene Understanding with World Knowledge for Open-World Embodied Reasoning

SNOW:基于世界知识的时空场景理解用于开放世界具身推理

Tin Stribor Sohn, Maximilian Dillitzer, Jason J. Corso, Eric Sax

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Esslingen University of Applied Sciences(埃斯林根应用科学大学) Dr. Ing. h.c. F. Porsche AG(德意志联邦汽车工业联合会) University of Michigan(密歇根大学) Voxel51 Inc.(Voxel51公司)

专题命中 具身推理 :robotics(abstract);navigation(abstract);world model(abstract);robotic(abstract)

AI总结 SNOW通过整合视觉语言模型与点云几何,实现统一的4D场景理解,提升开放世界具身推理的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12796 2025-12-19 cs.CV cs.AI 81%

DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving

DriveVLA-W0:世界模型放大数据扩展定律在自动驾驶中的应用

Yingyan Li, Shuyao Shang, Weisong Liu, Bing Zhan, Haochen Wang, Yuqi Wang, Yuntao Chen, Xiaoman Wang, Yasong An, Chufeng Tang, Lu Hou, Lue Fan, Zhaoxiang Zhang

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences (CASIA)(国家工程实验室、自动化研究所、中国科学院(CASIA)) Yinwang Intelligent Technology Co. Ltd.(云网智能科技有限公司)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 DriveVLA-W0通过世界建模预测未来图像,提升自动驾驶中数据扩展定律,实现更高效的驾驶智能。

详情

展开后加载摘要…

URL PDF HTML 收藏