arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 14066 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14066 篇

2602.22346 2026-06-24 cs.RO 版本更新 70%

A Pairwise Human-Human Interaction Detection and Recognition Framework for Mobile Service Robots

面向移动服务机器人的成对人-人交互检测与识别框架

Mengyu Liang, Iolanda Leite, Sarah Gillet

机构 * Wallenberg AI, Autonomous Systems and Software Program – Humanity and Society(瓦伦贝格人工智能、自主系统和软件计划—人类与社会)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出两阶段框架,先利用轻量几何和运动线索识别交互对,再通过关系网络分类交互类型,在JRDB数据集上以较低计算成本取得竞争性能,并在CAD和零样本数据集上验证泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22443 2026-06-23 cs.RO 新提交 70%

SPiralRoll: A Novel Adjustable-Stiffness Underactuated 3-DoF Joint with Torsion Springs for Rolling Robots

SPiralRoll: 一种用于滚动机器人的带有扭簧的新型可调刚度欠驱动三自由度关节

Louis Keith, George Ripper, and Seyed Amir Tafrishi

机构 * Cardiff University(卡迪夫大学)

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种基于扭簧的欠驱动柔性机构SPiralRoll,通过弧分布弹性件和双电机输入实现旋转、径向伸缩和轴向自旋三自由度运动,并集成到球形滚动机器人中验证其滚动与转向能力。

Comments 6 pages, Accepted to TAROS2026, Manchester

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22091 2026-06-23 cs.RO 新提交 70%

ACEsplat: Accelerated 3D Gaussian Scene Regression via RGB and Poses Only

ACEsplat: 仅通过RGB和姿态加速的3D高斯场景回归

Mingkai Liu, Haohua Que, Dikai Fan, Haojia Gao, Tianle Zhu, Handong Yao, Qian Zhang, Ruopeng Zhang, Xianliang Huang, Fei Qiao

机构 * Peking University(北京大学) University of Georgia(佐治亚大学) ByteDance(字节跳动) Tsinghua University(清华大学) Chongqing Vocational Institute of Engineering(重庆工程职业技术学院) Infinity Robotics

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 提出ACEsplat框架,通过自监督场景坐标回归和轻量级高斯初始化,仅用RGB图像和相机姿态实现快速3D高斯场景重建,无需外部几何先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20365 2026-06-19 cs.RO cs.MA 新提交 70%

An Infrastructure-less, Control-Independent Solution to Relative Localisation of a Team of Mobile Robots using Ranging Measurements

基于测距的移动机器人团队相对定位的无基础设施、控制无关解决方案

Paolo Golinelli, Tommaso Faraci, Daniele Fontanelli

机构 * Department of Industrial Engineering, University of Trento(特伦托大学工业工程系) Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种无锚点、完全去中心化的协作定位算法,仅依赖局部里程计、稀疏测距和短程通信,无需控制机器人运动即可实现团队可观测性,采用多假设贝叶斯框架保证鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19590 2026-06-19 cs.RO cs.SY eess.SY 新提交 70%

Safe, Real-Time Active Model Discrimination and Fault Diagnosis for Nonlinear Systems via Differentiable Reachability

通过可微可达性实现非线性系统的安全、实时主动模型辨识与故障诊断

Xinpei Ni, Melkior Ornik, Glen Chou, Samuel Coogan

机构 * Institute of Robotics and Intelligent Machines (IRIM), Georgia Institute of Technology(佐治亚理工学院机器人与智能机器研究所) Department of Aerospace Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校航空航天工程系)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对不确定非线性系统,提出一种基于可微可达性近似的实时主动故障诊断算法,通过优化控制输入使输出集分离,在保证安全的同时实现快速模型辨识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12220 2026-06-17 cs.CV cs.AI cs.LG cs.RO 70%

TriBand-BEV: Real-Time LiDAR-Only 3D Pedestrian Detection via Height-Aware BEV and High-Resolution Feature Fusion

TriBand-BEV:基于高度感知的鸟瞰图与高分辨率特征融合的实时仅LiDAR三维行人检测

Mohammad Khoshkdahan, Alexey Vinel

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出TriBand-BEV方法,通过高度感知的鸟瞰图与高分辨率特征融合实现实时LiDAR-only三维行人检测,采用轻量级鸟瞰图张量映射,单网络一次通过检测车辆、行人和自行车,提升检测精度与速度。

Comments Accepted for publication in the Proceedings of the 2026 International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026)

Journal ref Proceedings of the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19277 2026-06-17 cs.RO cs.SY eess.SY 70%

Ontology Neural Network and ORTSF: A Framework for Topological Reasoning and Delay-Robust Control

本体神经网络与ORTSF:一种用于拓扑推理和延迟鲁棒控制的框架

Jaehong Oh

机构 * Department of Mechanical Engineering Soongsil University, Seoul, Korea Email

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出Ontology Neural Network和ORTSF框架,解决现有方法在关系语义表示和动态环境中协作所需认知透明度的不足,通过统一架构实现语义认知与鲁棒控制的统一。

Comments 12 pages, 5 figures, includes theoretical proofs and simulation results

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15681 2026-06-16 cs.CV 新提交 70%

3D Consistency Optimization for Self-Supervised Monocular Video Depth Estimation

自监督单目视频深度估计的3D一致性优化

Yuanye Liu, Ke Zhang, Junzhe Jiang, Li Zhang, Vishal Patel, Xiahai Zhuang

机构 * Fudan University(复旦大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 具身导航 :embodied AI(abstract);navigation(abstract);分类 cs.CV

AI总结 提出一种将视频深度估计转化为多视图3D重建的框架,通过光度渲染、世界坐标对齐和多尺度时间梯度一致性约束,实现全局3D结构一致性,在自监督和零样本临床场景中达到最先进的空间精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14168 2026-06-15 cs.CV 新提交 70%

MUSE: Agentic 3D Scene Authoring via Memory-Grounded Incremental Requirement Satisfaction

MUSE: 基于记忆的增量需求满足的智能体3D场景创作

Ruijie Xu, Xinnan Zhu, Jiayu Ying, Daoguo Dong, Yuzhou Ji, Xin Tan

机构 * East China Normal University(华东师范大学) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 具身导航 :embodied AI(abstract);navigation(abstract);分类 cs.CV

AI总结 提出MUSE多智能体框架,通过增量需求满足实现可控3D场景构建与编辑,在AuthorBench上显著提升目标达成率和场景保持率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13990 2026-06-15 cs.RO 新提交 70%

SplatlessDF: Continuous Distance Field Mapping with Non-Splatting Gaussians

SplatlessDF: 基于非溅射高斯分布的连续距离场映射

Monisha Mushtary Uttsha, Lan Wu, Teresa Vidal-Calleja

机构 * UTS Robotics Institute, Faculty of Engineering and IT, University of Technology Sydney(悉尼科技大学工程与信息技术学院UTS机器人研究所) School of Engineering, University of Western Australia(西澳大学工程学院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出SplatlessDF框架,利用各向异性高斯元素从空间角度构建连续距离场,支持距离和梯度查询,并可与2D高斯溅射结合实现统一建模,适用于机器人导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13861 2026-06-15 cs.CV 新提交 70%

Temporal Backtracking Search for Test-time Generative Video Reasoning

时间回溯搜索:测试时生成式视频推理

Sejoon Jun, Zheng Ding, Huangyuan Su, Weirui Ye, Yilun Du

机构 * Northeastern University(东北大学) Independent Researcher(独立研究者) Harvard & Kempner(哈佛大学与肯普纳研究所) MIT(麻省理工学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 提出时间回溯搜索(TBS),通过将搜索空间转移到时间轴,在扩散过程中定位失败点并回溯重启,显著提升视频模型在测试时的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00379 2026-06-15 cs.CV 70%

NeRF: Neural Radiance Field in 3D Vision: A Comprehensive Review (Updated Post-Gaussian Splatting)

NeRF: 3D视觉中的神经辐射场:全面综述(更新后Gaussian Splatting发布后)

Kyle Gao, Yina Gao, Hongjie He, Dening Lu, Linlin Xu, Jonathan Li

机构 * Faculty of Engineering, University of Toronto(多伦多大学工程学院) Department of Geomatics Engineering, University of Calgary(卡尔加里大学测绘工程系)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 本文综述了NeRF在过去五年的研究,涵盖了在Gaussian Splatting出现前和后的发展,总结了NeRF在新颖视角合成和3D隐式和混合表示神经场学习中的应用和贡献。

Comments Updated Post-Gaussian Splatting

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13488 2026-06-12 cs.CV 新提交 70%

Point-Wise Geometry-Aware Transformer for Partial-to-Full Point Cloud Registration in Computer-Assisted Surgery

面向计算机辅助手术中部分到完整点云配准的点级几何感知Transformer

Siyu Zhou, Zhongliang Jiang

机构 * The Chair for Computer Aided Medical Procedures, Technical University of Munich(慕尼黑工业大学计算机辅助医疗程序教席) The University of Hong Kong(香港大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 提出GAPR-Net,一种结合卷积与Transformer的粗到细框架,通过交叉注意力融合局部与全局信息,并设计变换不变的点级几何特征,在四个骨骼数据集上实现94.2%配准召回率、1.992mm RMSE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12027 2026-06-11 cs.RO 新提交 70%

Learning Unions of Convex Sets via Invertible Latent Decomposition for Path Planning

通过可逆潜在分解学习凸集并集用于路径规划

Taerim Yoon, Dongho Kang, Kisang Park, Junha Cha, Stelian Coros, Sungjoon Choi

机构 * Korea University(高丽大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 提出ILD框架,联合学习可逆映射和潜在空间中的显式凸多面体并集,实现路径规划,并通过可见性引导采样保持凸集连通性,在多种环境中取得更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09294 2026-06-09 cs.CV 新提交 70%

Virtual-point-based Solutions to Handle Generalized Absolute Pose Problem

基于虚拟点的广义绝对位姿问题求解方法

Bin Li, Banglei Guan, Shunkun Liang, Yang Shang

机构 * National University of Defense Technology(国防科技大学) Hunan Institute of Advanced Technology(湖南高级技术研究所)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 针对多相机系统广义PnP问题,提出虚拟点公式化方法,将标准PnP求解器转化为广义位姿求解器,并基于Cayley、四元数和旋转矩阵参数化导出三种求解器,在精度、全局最优性和效率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19749 2026-06-09 eess.IV cs.CV 版本更新 70%

SPIRONet: Spatial-Frequency Learning and Graph-based Channel Interaction Network for Vessel Segmentation

SPIRONet:用于血管分割的空间-频率学习与基于图的通道交互网络

De-Xing Huang, Xiao-Hu Zhou, Xiao-Liang Xie, Shi-Qi Liu, Shuang-Yi Wang, Zhen-Qiu Feng, Mei-Jiang Gui, Hao Li, Tian-Yu Xiang, Bo-Xian Yao, Zeng-Guang Hou

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 提出SPIRONet,通过双空间-频率编码器、交叉注意力融合和基于图的通道交互模块,解决低信噪比、细小血管和强干扰下的血管分割难题,在五个数据集上取得最优性能。

Comments Accepted by Biomedical Signal Processing and Control. 15 Pages, 9 Figures, 13 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06829 2026-06-08 cs.RO 新提交 70%

Three-dimensional hydro-cluttered locomotion by an undulatory robot

三维水杂波环境中的波动机器人运动

Tianyu Wang, Matthew Fernandez, Galen Tunnicliffe, Nikolas Cornell, Justin Duong, Donoven Dortilus, Zhaochen J. Xu, Patricia Meza, Sean Lublinsky, Darsh Parikh, Jianfeng Lin, Emily Grace, Daniel I. Goldman

机构 * Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机器研究所,佐治亚理工学院) School of Physics, Georgia Institute of Technology(Georgia理工学院物理系) George W. Woodruff School of Mechanical Engineering, Georgia Institute of Technology(佐治亚理工学院乔治·W·伍德鲁夫机械工程学院) School of Electrical and Computer Engineering, Georgia Institute of Technology(佐治亚理工学院电气与计算机工程学院) Department of Mechanical and Industrial Engineering, Northeastern University(东北大学机械与工业工程系) Ransom Everglades School(拉森·伊弗格莱德学校)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 提出AquaMILR机器人,通过可编程体顺应性和深度调节,在三维水杂波环境中实现快速鲁棒的前进运动,并利用惯性滚动作为自发恢复机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06308 2026-06-05 cs.RO 70%

Attitude-Aided Linear Calibration of Triaxial Accelerometers

三轴加速度计的姿态辅助线性校准

Yongqiang Yu, Tian Huang, Yipeng Yang

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种利用姿态信息的三轴加速度计线性校准方法(ALAC),通过构建组合误差矩阵实现线性最小二乘估计,仅需五个任意方向测量即可完成校准,并在静态和准静态实验中验证了其精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26236 2026-06-05 cs.RO 70%

PHUMA: Physically Reliable Humanoid Locomotion Dataset

PHUMA:物理可靠的仿人运动数据集

Kyungmin Lee, Sibeen Kim, Youngdo Lee, Minho Park, Hyunseung Kim, Dongyoon Hwang, Donghu Kim, Hojoon Lee, Jaegul Choo

机构 * KAIST(韩国科学技术院)

专题命中 具身导航 :robotics(abstract,abstract_cn);分类 cs.RO

AI总结 本文提出PHUMA数据集,通过结合物理感知的筛选和物理约束的重定向,整合动作捕捉和网络视频,生成物理可靠的仿人运动数据,提升仿人运动的稳定性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07049 2026-06-05 cs.NE cs.LG 70%

GridPE: A Grid Cell-Inspired Unified Position Embedding for Arbitrary-Dimensional Spaces

GridPE: 一种基于网格细胞的统一位置嵌入方法用于任意维度空间

Boyang Li, Yulin Wu, Nuoxian Huang, Wenjia Zhang

机构 * New York University(纽约大学) Peking University(北京大学) Imperial College London(伦敦帝国学院) Tongji University(同济大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.LG

AI总结 本文提出GridPE,一种受哺乳动物空间认知中六边形周期编码启发的新型位置嵌入框架,旨在解决高维时空任务中位置嵌入的理论保障问题,通过结合计算神经科学原理和调和分析,为任意维度空间提供统一的位置嵌入解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.06133 2026-06-04 cs.RO cs.SY eess.SY 70%

A Fleet of Miniature Cars for Experiments in Cooperative Driving

用于合作驾驶实验的微型汽车车队

Nicholas Hyldmar, Yijun He, Amanda Prorok

机构 * University of Cambridge(剑桥大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文介绍了一种由16辆微型Ackermann转向车辆组成的独特实验平台,旨在解决多车导航和轨迹规划研究与教育中低成本平台不足的问题,通过实验展示合作驾驶在多车道道路地形中的优势。

Comments Accepted to ICRA 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.00627 2026-06-04 eess.SY cs.RO cs.SY 70%

Fast Rigid 3D Registration Solution: A Simple Method Free of SVD and Eigen-Decomposition

快速刚性三维配准解决方案:一种无需SVD和特征分解的简单方法

Jin Wu, Ming Liu, Zebo Zhou, Rui Li

机构 * School of Aeronautics and Astronautics, University of Electronic Science and Technology of China, Chengdu, 611731, China(电子科技大学航空宇航学院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种无需SVD和特征分解的快速刚性三维配准方法,通过点交叉协方差矩阵的最优特征向量计算实现高效配准,验证了其在噪声点云中的鲁棒性和速度优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
1608.07533 2026-06-04 math.OC cs.RO cs.SY eess.SY math.DS 70%

Near-Optimal Sensor Scheduling for Batch State Estimation: Complexity, Algorithms, and Limits

近优传感器调度用于批量状态估计:复杂性、算法与极限

Vasileios Tzoumas, Ali Jadbabaie, George J. Pappas

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文针对线性系统批量状态估计问题,提出一种在精度和时间复杂度上均优于现有算法的近优传感器调度算法,其解的质量接近最优解,并具有较低的计算复杂度。

Comments Correction of typos in proofs

详情

展开后加载摘要…

URL PDF HTML 收藏
1008.3760 2026-06-03 cs.RO cs.SY eess.SY math.OC 70%

Formal-language-theoretic Optimal Path Planning For Accommodation of Amortized Uncertainties and Dynamic Effects

形式语言理论最优路径规划以容纳摊销不确定性和动态效应

Ishanu Chattopadhyay, Anthony Cascone, Asok Ray

机构 * Department of Mechanical Engineering, The Pennsylvnaia State University, University Park, 16802(机械工程系,宾夕法尼亚州立大学,University Park)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出基于形式语言定量测度理论的全局最优路径规划方法,通过引入概率不可控转移建模不确定性,并采用无搜索组合优化最大化概率正则语言测度,实现机器人导航中目标到达概率最大化与障碍碰撞概率最小化。

Comments Submitted for review for possible publication elsewhere; journal reference will be added when available

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01892 2026-06-02 cs.CV 70%

Adversarial Attacks on Robot Localization Systems via Deep Feature Perturbation

通过深度特征扰动对机器人定位系统的对抗攻击

Zhenyu Li, Tianyi Shang

机构 * Shandong Academy of Sciences(山东科学院) Fuzhou University(福州大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 提出一种基于轻量级乘积量化网络(LPQN)的对抗攻击框架,通过扰动查询特征编码来误导视觉定位系统中的检索过程,从而暴露深度学习定位管道的脆弱性。

Comments 11page

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00762 2026-06-02 cs.RO 70%

STEM: Semantic Target Search and Exploration using MAVs in Cluttered Environments

STEM: 杂乱环境中使用MAV的语义目标搜索与探索

Nikhil Sethi, Max Lodel, Laura Ferranti, Robert Babuška, Javier Alonso-Mora

机构 * Department of Cognitive Robotics(认知机器人学系) Delft University of Technology(代尔夫特理工大学) CIIRC(捷克技术大学布拉格分校智能信息研究中心)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种基于语义引导视点规划器的框架,利用MAV在非结构化3D环境中最小化目标搜索与探索时间,通过组合规划器和主动感知管道实现高效语义探索。

Comments Accepted to Autonomous Robots Journal. Nikhil Sethi and Max Lodel contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27095 2026-06-02 cs.LG 70%

Adversarial Dual On-Policy Distillation from Expressive Teacher

来自表达性教师的对抗性双在线策略蒸馏

Zhenglin Wan, Jingxuan Wu, Xingrui Yu, Chubin Zhang, Mingcong Lei, Bo An, Ivor W. Tsang, Yang You

机构 * National University of Singapore(新加坡国立大学) University of Technology Sydney(悉尼大学) University of Science and Technology of China(中国科学技术大学)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.LG

AI总结 提出FA-OPD方法,通过对抗性双在线策略蒸馏,结合流匹配教师和轻量MLP学生,利用奖励和动作双通道信号,在机器人导航、操作和运动任务中优于强基线,且对噪声和有限演示鲁棒。

Comments arXiv admin note: substantial text overlap with arXiv:2510.09222

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27314 2026-05-27 cs.RO cs.SY eess.SY 70%

Riding the Shifting Potential: When Reactive Control Suffices for Multi-Goal Behavior

驾驭变化势场:何时反应控制足以实现多目标行为

Vito Mengers, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin(技术大学柏林机器人与生物学实验室) Science of Intelligence (SCIoI), Cluster of Excellence, Berlin, Germany(智能科学(SCIoI),卓越中心,柏林,德国) Robotics Institute Germany(德国机器人研究所)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO

AI总结 本文提出通过零空间投影扩展图基世界模型中的交互结构,动态调整优先级以解决多目标冲突,在非凸障碍导航和非凸物体推拉任务中实现100%成功率,无需演示或重新训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26637 2026-05-27 cs.RO 70%

Enabling Extensible Embodied Capabilities with Tools

利用工具实现可扩展的具身能力

Xueyang Zhou, Zijia Wang, Qianjiang Li, Yibo Hu, Guiyao Tie, Li Wan, Yidan Liu, Pan Zhou, Lichao Sun, Yongchao Chen

机构 * Huazhong University of Science and Technology(华中科技大学) Hebei University of Technology(河北工业大学) Tianjin University(天津大学) Lehigh University(莱特大学) College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 具身导航 :navigation(abstract,abstract_cn);分类 cs.RO

AI总结 提出一种通过外部化能力为工具、并借助标准化协议ETP动态调用工具的方法,在仿真和真实平台上平均提升具身性能31%-36%,但揭示了工具使用在认知和感知方面增益显著而在执行方面有限。

Comments 51 pages, 20 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18746 2026-05-26 cs.CV cs.AI cs.CL cs.LG cs.RO 70%

ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop

ESI-Bench: 迈向闭环感知-动作的具身空间智能

Yining Hong, Jiageng Liu, Han Yin, Manling Li, Leonidas Guibas, Li Fei-Fei, Jiajun Wu, Yejin Choi

机构 * Stanford University(斯坦福大学) UCLA(加州大学洛杉矶分校) Northwestern University(西北大学)

专题命中 具身导航 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出ESI-BENCH基准,通过主动探索(感知、移动、操作)在OmniGibson环境中评估具身空间智能,发现主动探索显著优于被动方法,失败主因是动作盲视而非感知弱,且模型存在元认知差距。

Comments https://esi-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏