arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-23 至 2025-12-23 共收录 78 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 13 篇

2410.15178 2025-12-23 cs.RO cs.AI cs.LG cs.SY eess.SY 85%

GUIDEd Agents: Enhancing Navigation Policies through Task-Specific Uncertainty Abstraction in Localization-Limited Environments

GUIDEd Agents: 通过在定位受限环境中任务特定的不确定性抽象增强导航策略

Gokul Puthumanaillam, Paulo Padrao, Jose Fuentes, Leonardo Bobadilla, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Providence College(普罗维登斯学院) Florida International University(佛罗里达国际大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 GUIDE通过任务特定不确定性抽象提升机器人在定位受限环境中的导航策略,实现任务完成与不确定性管理的平衡。

Comments Accepted for publication at RAL (Robotics and automation letters). Updated with the final version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19024 2025-12-23 cs.RO cs.AI 84%

IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments

IndoorUAV:在连续室内环境中进行视觉-语言无人机导航的基准测试

Xu Liu, Yu Liu, Hanshuo Qiu, Yang Qirong, Zhouhui Lian

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 IndoorUAV通过构建室内无人机视觉-语言导航基准,结合多模态推理和任务分解,为长视距和短视距导航提供高质量数据与模型支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18028 2025-12-23 cs.RO cs.CV 84%

Embodied4C: Measuring What Matters for Embodied Vision-Language Navigation

Embodied4C: 评估具身视觉-语言导航中至关重要的因素

Tin Stribor Sohn, Maximilian Dillitzer, Jason J. Corso, Eric Sax

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) UAS Esslingen(埃森嫩大学) TU Wien(维也纳技术大学) Dr. Ing. h.c. F. Porsche AG(保时捷股份有限公司) University of Michigan(密歇根大学) Voxel51 Inc.(Voxel51公司)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 Embodied4C通过三种异构具身评估VLMs的具身能力,发现跨模态对齐和指令微调比规模更重要,而空间和时间推理是可靠具身能力的主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10101 2025-12-23 cs.RO 79%

Agile and Safe Trajectory Planning for Quadruped Navigation with Motion Anisotropy Awareness

具备运动各向异性意识的四足机器人导航轨迹规划

Wentao Zhang, Shaohang Xu, Peiyuan Cai, Lijun Zhu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology, China(华中科技大学人工智能与自动化学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种考虑四足机器人运动各向异性的导航框架,通过轨迹生成与优化提升导航效率和安全性。

Comments 8 pages, 6 figures, submitted to 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12106 2025-12-23 cond-mat.soft 78%

Optimal chemotactic navigation in disordered landscapes

在杂乱景观中最优趋化导航

Yang Bai, Caiyun He, Weirong Liu, Songtao Cheng, Pan Chu, Liang Luo, Chenli Liu, Xiongfei Fu

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究揭示了在杂乱环境中趋化导航的最优策略,通过分析大肠杆菌在琼脂凝胶中的行为,发现最优运行时间与环境密度之间的非单调关系,并提出对抗性缩放理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04258 2025-12-23 math.OC 71%

Safe Navigation in the Presence of Range-Limited Pursuers

在范围受限追捕者存在下的安全导航

Thomas Chapman, Alexander Von Moll, Isaac E. Weintraub

专题命中 具身导航 :navigation(title)

AI总结 本文提出了一种实时控制方法,使逃避者在了解范围受限追捕者信息的情况下,能更安全地接近目标并缩短路径。

Comments Submitted to American Control Conference 2026, in IEEE Control Systems Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06741 2025-12-23 cs.CV cs.RO 66%

Event Spectroscopy: Event-based Multispectral and Depth Sensing using Structured Light

事件光谱:基于事件的多光谱和深度感知使用结构光

Christian Geckeler, Niklas Neugebauer, Manasi Muglikar, Davide Scaramuzza, Stefano Mintchev

机构 * Environmental Robotics Laboratory, Dep. of Environmental Systems Science, ETH Zurich(环境机器人实验室,环境系统科学系,苏黎世联邦理工学院) Swiss Federal Institute for Forest, Snow and Landscape Research (WSL)(瑞士森林、雪和景观研究联邦研究所) Robotics and Perception Group, University of Zurich(机器人与感知小组,苏黎世大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 本研究提出了一种基于事件的多光谱和深度感知系统,利用结构光实现高分辨率、低延迟的深度重建和多光谱成像,在森林环境中提升UAV的感知与数据收集能力。

Comments This work has been accepted for publication in IEEE Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18082 2025-12-23 cs.CV cs.AI 62%

Uncertainty-Gated Region-Level Retrieval for Robust Semantic Segmentation

不确定性门控区域级检索用于鲁棒语义分割

Shreshth Rajan, Raymond Liu

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本文提出一种不确定性门控区域级检索机制,提升语义分割在域移位下的鲁棒性和精度,实现分割准确率提升11.3%且检索成本降低87.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17098 2025-12-23 cs.CV 57%

Predictive Modeling of Maritime Radar Data Using Transformer Architecture

使用变换器架构预测海运雷达数据

Bjorna Qesaraku, Jan Steckel

机构 * Cosys-lab, Faculty of applied Engineering, University of Antwerp(Cosys-lab,应用工程学院,安特卫普大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文探讨了基于变换器架构的海运雷达数据预测方法,发现现有研究在该领域存在空白,需进一步探索

Comments 9 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08817 2025-12-23 cs.RO 57%

Geometric Data-Driven Multi-Jet Locomotion Inspired by Salps

几何数据驱动的多喷嘴运动机制受樽海鞘启发

Yanhao Yang, Nina L. Hecht, Yousef Salaman-Maclara, Nathan Justus, Zachary A. Thomas, Farhan Rozaidi, Ross L. Hatton

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出基于几何力学的樽海鞘启发机器人模型,通过数据驱动方法实现高效水下运动控制,展示多喷嘴推进与形状调节能力。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05277 2025-12-23 cs.CV 57%

Text to Blind Motion

文本到盲人运动

Hee Jae Kim, Kathakoli Sengupta, Masaki Kuribayashi, Hernisa Kacorri, Eshed Ohn-Bar

机构 * Boston University(波士顿大学) Waseda University(早稻田大学) University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出BlindWays,首个针对盲人行人的多模态运动基准,通过收集盲人真实环境中的3D运动数据及文本描述,评估现有3D运动模型在处理盲人独特运动模式时的不足,以提升自动驾驶等系统对多样化人类运动的推理能力。

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18779 2025-12-23 cs.CL physics.acc-ph 50%

From Natural Language to Control Signals: A Conceptual Framework for Semantic Channel Finding in Complex Experimental Infrastructure

从自然语言到控制信号:复杂实验基础设施中语义通道寻找的概念框架

Thorsten Hellert, Nikolay Agladze, Alex Giovannone, Jan Jug, Frank Mayet, Mark Sherwin, Antonin Sulc, Chris Tennant

机构 * Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室) University of California Santa Barbara(加州大学圣巴巴拉分校) Deutsches Elektronen-Synchrotron DESY(德意志电子同步辐射研究中心DESY) Thomas Jefferson National Accelerator Facility(托马斯·杰斐逊国家加速器设施) Cosylab USA(Cosylab美国分公司)

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出了一种概念框架,用于在复杂实验基础设施中通过语义方法寻找控制信号,通过四个范式指导架构选择,实现了90-97%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 6 篇

2512.18619 2025-12-23 cs.AI cs.RO 90%

ChronoDreamer: Action-Conditioned World Model as an Online Simulator for Robotic Planning

ChronoDreamer:基于动作的动态世界模型作为机器人规划的在线模拟器

Zhenhao Zhou, Dan Negrut

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 具身推理 :world model(title,abstract);robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 ChronoDreamer通过时空变换器和视觉-语言模型,实现基于动作的动态世界模型,用于机器人规划中的安全动作预测与碰撞检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV 81%

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08139 2025-12-23 cs.IT cs.LG math.IT 79%

SCA-LLM: Spectral-Attentive LLM-Based Wireless World Modeling for Agentic Communications

SCA-LLM:基于频谱-注意力的LLM无线世界建模用于智能通信

Ke He, Le He, Lisheng Fan, Xianfu Lei, Thang X. Vu, George K. Karagiannidis, Symeon Chatzinotas

机构 * Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(安全、可靠性与信任跨学科研究中心(SnT),卢森堡大学) School of Computer Science of Guangzhou University(广州大学计算机科学学院) School of Information Science and Technology, Institute of Mobile Communications, Southwest Jiaotong University(信息科学与技术学院,移动通信研究所,西南交通大学) Department of Electrical and Computer Engineering, Aristotle University of Thessaloniki(电气与计算机工程系,塞萨洛尼基阿瑞斯托大学) Cyber Security Systems and Applied AI Research Center, Lebanese American University (LAU)(网络安全与应用人工智能研究中心,黎巴嫩美国大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 SCA-LLM通过频谱-注意力适配器将信道状态信息与LLM结合,实现无线世界建模,提升预测性能和零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17992 2025-12-23 cs.RO 77%

Unifying Deep Predicate Invention with Pre-trained Foundation Models

统一深度谓词发明与预训练基础模型

Qianwei Wang, Bowen Li, Zhanpeng Luo, Yifan Xu, Alexander Gray, Tom Silver, Sebastian Scherer, Katia Sycara, Yaqi Xie

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Computer Science and Engineering Division, University of Michigan(密歇根大学计算机科学与工程系) Department of Computer Science, University of Pittsburgh(匹兹堡大学计算机科学系) Centaur AI Institute(Centaur人工智能研究所) Department of Electrical and Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系)

专题命中 具身推理 :robotics(abstract);world model(abstract);robotic(abstract);分类 cs.RO

AI总结 UniPred通过双层学习框架统一深度谓词发明与预训练基础模型,提升机器人任务的可扩展性和灵活性。

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18489 2025-12-23 cs.AI 57%

Large Language Models as Discounted Bayesian Filters

大语言模型作为折扣贝叶斯滤波器

Jensen Zhang, Jing Yang, Keze Wang

机构 * Sun Yat-sen University(中山大学)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 本研究提出了一种贝叶斯过滤框架,揭示大语言模型在动态环境中的信念更新机制,并提出提示策略以优化其先验校准。

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07576 2025-12-23 cs.CV 57%

Super Encoding Network: Recursive Association of Multi-Modal Encoders for Video Understanding

超级编码网络:多模态编码器的递归关联用于视频理解

Boyu Chen, Siran Chen, Kunchang Li, Qinglin Xu, Yu Qiao, Yali Wang

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) the School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 本文提出超级编码网络,通过递归关联多模态编码器提升视频理解性能,显著提升跟踪、识别、聊天和编辑等任务效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 2 篇

2512.18007 2025-12-23 cs.RO cs.CV 84%

Robotic VLA Benefits from Joint Learning with Motion Image Diffusion

机器人VLA通过与运动图像扩散的联合学习获益

Yu Fang, Kanchana Ranasinghe, Le Xue, Honglu Zhou, Juntao Tan, Ran Xu, Shelby Heinecke, Caiming Xiong, Silvio Savarese, Daniel Szafir, Mingyu Ding, Michael S. Ryoo, Juan Carlos Niebles

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 机器人基础模型 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出通过联合学习与运动图像扩散提升机器人VLA模型的运动推理能力,实验表明在多个基准测试中显著提升了性能。

Comments Website: https://vla-motion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11960 2025-12-23 cs.RO 57%

Human Centric General Physical Intelligence for Agile Manufacturing Automation

以人为中心的敏捷制造通用物理智能

Sandeep Kanta, Mehrdad Tavassoli, Varun Teja Chirkuri, Venkata Akhil Kumar, Santhi Bharath Punati, Praveen Damacharla, Sunny Katyara

机构 * Northeastern University(东北大学) Bmade Robotics(Bmade机器人)

专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO

AI总结 本文探讨了通过VLA模型实现通用物理智能在敏捷制造中的应用,系统回顾了最新进展并提出未来研究方向。

Comments Advanced Engineering Informatics

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2512.18571 2025-12-23 cs.AI cs.CV 73%

ESearch-R1: Learning Cost-Aware MLLM Agents for Interactive Embodied Search via Reinforcement Learning

ESearch-R1: 通过强化学习学习成本感知的多模态大语言模型代理以进行交互式具身搜索

Weijie Zhou, Xuangtang Xiong, Ye Tian, Lijun Yue, Xinyu Wu, Wei Li, Chaoyang Zhao, Honghui Dong, Ming Tang, Jinqiao Wang, Zhengyou Zhang

机构 * School of Traffic and Transportation, Beijing Jiaotong University(交通与运输学院,北京交通大学) Tencent Robotics X & Futian Laboratory(腾讯机器人X与福田实验室) Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(基础模型研究中心,中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 模仿学习与强化学习 :embodied agent(abstract);navigation(abstract);分类 cs.AI、cs.CV

AI总结 ESearch-R1通过强化学习方法,结合交互对话、记忆检索和导航,实现成本感知的多模态大语言模型代理,有效降低任务执行成本并提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18436 2025-12-23 cs.RO 70%

Evaluating the Pre-Dressing Step: Unfolding Medical Garments Via Imitation Learning

评估预穿衣步骤:通过模仿学习展开医疗服装

David Blanco-Mulero, Júlia Borràs, Carme Torras

机构 * Institut de Robòtica i Informàtica Industrial, CSIC-UPC(机器人与信息技术工业研究所,CSIC-UPC)

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文通过模仿学习研究预穿衣步骤,利用操作原语和视觉分类器提高医疗服装展开效率。

Comments 6 pages, 4 figures, 2 tables. Accepted to IEEE/RSJ IROS 2025. Project website: https://sites.google.com/view/pre-dressing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18670 2025-12-23 cs.LG 57%

Demonstration-Guided Continual Reinforcement Learning in Dynamic Environments

动态环境中的演示引导持续强化学习

Xue Yang, Michael Schukat, Junlin Lu, Patrick Mannion, Karl Mason, Enda Howley

机构 * School of Computer Science, University of Galway(Galway大学计算机科学学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

AI总结 本研究提出演示引导持续强化学习(DGCRL),通过外部演示库指导智能体探索与适应,提升动态环境中的学习效率和知识迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2512.18712 2025-12-23 cs.RO 79%

DSO-VSA: a Variable Stiffness Actuator with Decoupled Stiffness and Output Characteristics for Rehabilitation Robotics

DSO-VSA:一种具有解耦刚度和输出特性的可变刚度执行器用于康复机器人

Maozeng Zhang, Ke Shi, Huijun Li, Tongshu Chen, Jiejun Yan, Aiguo Song

专题命中 人机交互与遥操作 :robotics(title,abstract);分类 cs.RO

AI总结 DSO-VSA 通过解耦刚度与输出特性,提供了一种适用于康复机器人的可变刚度执行器,实现了连续刚度调节和双电机负载共享。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 18 篇

2512.19390 2025-12-23 cs.RO cs.CV cs.GR 88%

TwinAligner: Visual-Dynamic Alignment Empowers Physics-aware Real2Sim2Real for Robotic Manipulation

TwinAligner: 视觉-动态对齐赋能物理感知的实境到仿真到现实的机器人操控

Hongwei Fan, Hang Dai, Jiyao Zhang, Jinzhou Li, Qiyang Yan, Yujie Zhao, Mingju Gao, Jinghang Wu, Hao Tang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学CFCS) PKU-AgiBot Lab(北京大学AgiBot实验室) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学)

专题命中 机器人数据与评测 :manipulation(title);robotic(title);robotics(abstract);robot learning(abstract)

AI总结 TwinAligner通过视觉和动态对齐技术,解决仿真与现实之间的差距,提升机器人操控的可扩展学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19562 2025-12-23 cs.RO cs.AI 87%

REALM: A Real-to-Sim Validated Benchmark for Generalization in Robotic Manipulation

REALM:一种用于机器人操作中泛化能力评估的实-仿真实验室基准

Martin Sedlacek, Pavlo Yefanov, Georgy Ponimatkin, Jai Bardhan, Simon Pilc, Mederic Fourmy, Evangelos Kazakos, Cees G. M. Snoek, Josef Sivic, Vladimir Petrik

机构 * Czech Institute of Informatics, Robotics and Cybernetics(捷克信息学、机器人学与自动化研究所) Czech Technical University in Prague(布拉格捷克技术大学) Faculty of Electrical Engineering(电气工程学院) University of Amsterdam(阿姆斯特丹大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title);分类 cs.RO、cs.AI

AI总结 REALM通过高保真仿真环境评估VLA模型在机器人操作中的泛化能力,揭示了其在现实世界中的挑战和局限性。

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19021 2025-12-23 cs.CV cs.RO 84%

VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation

VLNVerse: 一个用于视觉语言导航的基准,具备多用途、具身体验、逼真模拟和评估

Sihao Lin, Zerui Li, Xunyi Zhao, Gengze Zhou, Liuyi Wang, Rong Wei, Rui Tang, Juncheng Li, Hanqing Wang, Jiangmiao Pang, Anton van den Hengel, Jiajun Liu, Qi Wu

机构 * Adelaide University(阿德莱德大学) Responsible AI Research Centre, Australian Institute for Machine Learning(负责任人工智能研究中心、澳大利亚机器学习研究所) Tongji University(同济大学) ManyCore Zhejiang University(浙江大学) Shanghai AI Lab(上海人工智能实验室) CSIRO Data61

专题命中 机器人数据与评测 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 VLNVerse是一个大规模、可扩展的视觉语言导航基准,通过多用途、具身体验和逼真模拟提升导航任务的泛化能力与研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13524 2025-12-23 cs.AI cs.HC 83%

FreeAskWorld: An Interactive and Closed-Loop Simulator for Human-Centric Embodied AI

FreeAskWorld: 一种面向人类的交互式闭环模拟器用于具身人工智能

Yuhang Peng, Yizhou Pan, Xinning He, Jihaoyu Yang, Xinyu Yin, Han Wang, Xiaoji Zheng, Chao Gao, Jiangtao Gong

专题命中 机器人数据与评测 :embodied AI(title,abstract);navigation(abstract);分类 cs.AI

AI总结 FreeAskWorld通过整合大语言模型和交互式闭环模拟,提升具身人工智能在复杂社会行为和自然交互中的表现。

Comments 9 pages, 4 figures

Journal ref AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09543 2025-12-23 cs.RO cs.CV cs.LG 83%

Benchmarking the Sim-to-Real Gap in Cloth Manipulation

在织物操控中评估仿真到现实的差距基准测试

David Blanco-Mulero, Oriol Barbany, Gokhan Alcan, Adrià Colomé, Carme Torras, Ville Kyrki

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO、cs.CV、cs.LG;robotics(comments)

AI总结 本文提出一个开源基准数据集,用于评估织物操控中仿真与现实之间的差距,测试四个主流模拟器的性能与稳定性。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L). 8 pages, 6 figures. Supplementary material available at https://sites.google.com/view/cloth-sim2real-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02190 2025-12-23 cs.RO cs.LG 74%

cVLA: Towards Efficient Camera-Space VLAs

cVLA:迈向高效的相机空间VLA

Max Argus, Jelena Bratulic, Houman Masnavi, Maxim Velikanov, Nick Heppert, Abhinav Valada, Thomas Brox

机构 * University of Freiburg(弗赖堡大学)

专题命中 机器人数据与评测 :manipulation(abstract,comments);robotic(abstract);分类 cs.RO、cs.LG

AI总结 cVLA通过利用视觉语言模型在2D图像上的性能,提出了一种高效预测机器人轨迹的VLA方法,具备良好的仿真到现实迁移能力。

Comments 20 pages, 10 figures; CoRL 2025 Workshop on Generalizable Priors for Robot Manipulation

详情

展开后加载摘要…

URL PDF HTML 收藏