arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-01 至 2026-01-01 共收录 60 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 12 篇

2506.23614 2026-01-01 cs.RO cs.CG 57%

Passage-traversing optimal path planning with sampling-based algorithms

基于采样算法的路径穿越最优规划

Jing Huang, Hao Su, Kwok Wai Samuel Au

机构 * Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong, Hong Kong, China(香港中文大学机械与自动化工程系) Multi-Scale Medical Robotics Center, Hong Kong, China(香港医学机器人多尺度中心) Department of Computer Science and Engineering, University of California, San Diego, CA, USA(加州大学圣地亚哥分校计算机科学与工程系) Hillbot Inc., USA(Hillbot公司)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种基于采样算法的路径穿越最优规划方法,通过通道检测和自由空间分解提升路径规划的效率和优化能力。

Comments 27 pages, 20 figures, 4 tables, journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13796 2026-01-01 cond-mat.mtrl-sci 56%

Geographic-style maps with a local novelty distance help navigate the materials space

具有局部新颖距离的地理风格地图帮助导航材料空间

Daniel E Widdowson, Vitaliy A Kurlin

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文提出了一种基于局部新颖距离的地理风格地图,用于快速导航材料空间,帮助自动驾驶实验室识别新颖材料。

Comments 20 pages, 13 figures. The paper has been published in Scientific Reports, v.15, 27588 (2025). The latest version is maintained at http://kurlin.org/projects/computational-materials-science/navigation-maps.pdf

Journal ref Scientific Reports, v.15, 27588 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24916 2026-01-01 math.OC math.PR 50%

A Pontryagin Maximum Principle on the Belief Space for Continuous-Time Optimal Control with Discrete Observations

关于信念空间的庞特里亚金极大值原理用于连续时间最优控制与离散观测

Christian Bayer, Saifeddine Ben naamia, Erik von Schwerin, Raul Tempone

专题命中 具身导航 :robotic(abstract)

AI总结 本文提出在信念空间中基于庞特里亚金极大值原理的连续时间最优控制方法,结合粒子滤波与回归技术,解决部分信息下的最优控制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24722 2026-01-01 cs.NE 50%

Equivalence of Personalized PageRank and Successor Representations

个性化PageRank与后继表示的等价性

Beren Millidge

专题命中 具身导航 :navigation(abstract)

AI总结 本文证明了个性化PageRank与后继表示在计算上等价,均基于图的稳态分布。

Comments Initiai upload 30/12/25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12980 2026-01-01 eess.SP cs.MS math.OC 50%

Algorithms for Nonlinear Mixed-Integer Location Estimation

非线性混合整数定位估计的算法

Ophir Uziel, Efi Fogel, Dan Halperin, Sivan Toledo

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出非线性混合整数定位估计的算法,针对陆地和室内环境,通过消除非线性项和高效枚举整数解,解决定位问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 1 篇

2505.20425 2026-01-01 cs.RO 70%

OSVI-WM: One-Shot Visual Imitation for Unseen Tasks using World-Model-Guided Trajectory Generation

OSVI-WM:通过世界模型引导轨迹生成实现单次视觉模仿

Raktim Gautam Goswami, Prashanth Krishnamurthy, Yann LeCun, Farshad Khorrami

机构 * New York University Tandon School of Engineering(纽约大学Tandon工程学院) New York University Courant Institute of Mathematical Sciences(纽约大学Courant数学科学研究所) Meta-FAIR

专题命中 具身推理 :world model(abstract);robotic(abstract);分类 cs.RO

AI总结 OSVI-WM通过世界模型引导轨迹生成,实现对未见任务的单次视觉模仿学习,提升机器人执行复杂任务的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 1 篇

2512.24673 2026-01-01 cs.RO cs.AI cs.SY eess.SY 79%

VLA-RAIL: A Real-Time Asynchronous Inference Linker for VLA Models and Robots

VLA-RAIL:一种用于VLA模型和机器人的实时异步推理链接器

Yongsheng Zhao, Lei Zhao, Baoping Cheng, Gongxin Yao, Xuanzhang Wen, Han Gao

机构 * China Mobile (Hangzhou) Information Technology Co., Ltd.(中国移动(杭州)信息技术有限公司)

专题命中 机器人基础模型 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 VLA-RAIL通过异步推理和轨迹平滑技术,提升机器人动作执行的连续性和速度,提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2512.24461 2026-01-01 cs.AI 74%

Align While Search: Belief-Guided Exploratory Inference for World-Grounded Embodied Agents

对齐而搜索:基于信念的探索性推理用于世界感知的具身智能体

Seohui Bae, Jeonghye Kim, Youngchul Sung, Woohyung Lim

机构 * LG AI Research(LG人工智能研究) KAIST(韩国科学技术院)

专题命中 模仿学习与强化学习 :embodied agent(title);分类 cs.AI

AI总结 本文提出了一种基于信念的探索性推理方法,通过后验引导和轻量级模型实现高效的世界对齐,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24288 2026-01-01 cs.RO 70%

Real-world Reinforcement Learning from Suboptimal Interventions

现实世界中的基于次优干预的强化学习

Yinuo Zhao, Huiqian Jin, Lechun Jiang, Xinyi Zhang, Kun Wu, Pei Ren, Zhiyuan Xu, Zhengping Che, Lei Sun, Dapeng Wu, Chi Harold Liu, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) City University of Hong Kong(香港城市大学) Nankai University(南开大学) Beijing Institute of Technology(北京理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 SiLRI通过状态级拉格朗日强化学习算法,利用次优和噪声的人类干预加速机器人操作学习,显著提高了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24532 2026-01-01 cs.AI cs.CL 57%

From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning

从积木到规划:通过强化学习在LLMs中实现多步骤空间推理

Amir Tahmasbi, Sadegh Majidi, Kazem Taram, Aniket Bera

机构 * Department of Computer Science(计算机科学系)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

AI总结 本文提出了一种两阶段方法,通过强化学习在LLMs中实现多步骤空间推理,通过微调和LoRA适配器提升模型在结构环境中的空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 3 篇

2512.24129 2026-01-01 cs.RO cs.SY eess.SY 74%

ROBOPOL: Social Robotics Meets Vehicular Communications for Cooperative Automated Driving

ROBOPOL:社会机器人与车辆通信相结合以实现协作自动驾驶

Manuel Bied, John Arockiasamy, Andy Comeca, Maximilian Schrapel, Victoria Yang, Alexey Rolich, Barbara Bruno, Maike Schwammberger, Dieter Fiems, Alexey Vinel

专题命中 人机交互与遥操作 :robotics(title);分类 cs.RO

AI总结 ROBOPOL提出利用社会机器人作为自动驾驶车辆与行人之间的调节器,通过整合先进感知、车辆通信、社会交互和形式化规范,实现协作自动驾驶场景中的安全交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17821 2026-01-01 cs.RO cs.AI cs.LG 67%

CAML: Collaborative Auxiliary Modality Learning for Multi-Agent Systems

CAML: 多智能体系统中的协同辅助模态学习

Rui Liu, Yu Shen, Peng Gao, Pratap Tokekar, Ming Lin

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) Adobe Research(Adobe 研究院) North Carolina State University(北卡罗来纳州立大学)

专题命中 人机交互与遥操作 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 CAML通过多智能体协作和共享多模态数据,提升多模态学习在资源受限环境下的性能,实现事故检测和语义分割的显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24829 2026-01-01 cs.AI cs.HC cs.RO 62%

Explaining Why Things Go Where They Go: Interpretable Constructs of Human Organizational Preferences

解释为何事物会去往它们去的地方:人类组织偏好的可解释性构建

Emmanuel Fashae, Michael Burke, Leimin Tian, Lingheng Meng, Pamela Carreno-Medrano

机构 * Monash University, CSIRO Robotics(墨尔本大学,CSIRO机器人研究所) Monash University(墨尔本大学)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出四个可解释性构建来表现场景安排偏好,通过MCTS规划器验证其在厨房和客厅场景中的实用性,为机器人规划提供可解释的偏好模型。

Comments Accepted to the 2026 ACM/IEEE International Conference on Human-Robot Interaction (HRI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 11 篇

2512.16881 2026-01-01 cs.RO cs.LG 79%

PolaRiS: Scalable Real-to-Sim Evaluations for Generalist Robot Policies

PolaRiS:面向通用机器人策略的可扩展真实-仿真评估

Arhan Jain, Mingtong Zhang, Kanav Arora, William Chen, Marcel Torne, Muhammad Zubair Irshad, Sergey Zakharov, Yue Wang, Sergey Levine, Chelsea Finn, Wei-Chiu Ma, Dhruv Shah, Abhishek Gupta, Karl Pertsch

机构 * University of Washington(华盛顿大学) Princeton University(普林斯顿大学) University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) Toyota Research Institute(丰田研究中心) University of Southern California(南加州大学) Cornell University(康奈尔大学)

专题命中 机器人数据与评测 :robotics(abstract);robot learning(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 PolaRiS通过神经重建和数据协同训练,实现高保真度的机器人策略真实-仿真评估,提升仿真与现实的关联性并简化环境构建。

Comments Website: https://polaris-evals.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23739 2026-01-01 cs.CL cs.AI cs.CV cs.RO 75%

Break Out the Silverware -- Semantic Understanding of Stored Household Items

拿出银器——对存储家居物品的语义理解

Michaela Levi-Richter, Reuth Mirsky, Oren Glickman

机构 * Bar Ilan University, Computer Science Department(巴伊兰大学计算机科学系) Tufts University, Department of Computer Science(塔夫茨大学计算机科学系)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本研究提出NOAM模型,通过结合结构化场景理解和大语言模型推理,实现对家庭物品存储位置的语义理解,显著提升预测准确率并接近人类水平。

Comments Poster presented at the Israeli Seminar on Computational Linguistics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02761 2026-01-01 cs.AI 70%

Plan Verification for LLM-Based Embodied Task Completion Agents

基于大语言模型的体感任务完成代理的计划验证

Ananth Hariharan, Vardhan Dongre, Dilek Hakkani-Tür, Gokhan Tur

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :embodied AI(abstract);navigation(abstract);分类 cs.AI

AI总结 本文提出基于自然语言提示的体感任务代理计划验证框架,通过迭代修正提升动作序列质量,实现高召回率和精确度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24321 2026-01-01 cs.CV cs.RO 62%

UniAct: Unified Motion Generation and Action Streaming for Humanoid Robots

UniAct:面向人形机器人的统一动作生成与动作流

Nan Jiang, Zimo He, Wanhe Yu, Lexi Pang, Yunhao Li, Hongjie Li, Jieming Cui, Yuhan Li, Yizhou Wang, Yixin Zhu, Siyuan Huang

机构 * Institute for AI, Peking University(人工智能研究院,北京大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) School of Psychological and Cognitive Sciences, Peking University(心理学与认知科学学院,北京大学) School of Computer Science, Peking University(计算机科学学院,北京大学) Yuanpei College, Peking University(元培学院,北京大学) School of Foreign Languages, Peking University(外语学院,北京大学) School of EECS, Peking University(电子工程与科学学院,北京大学) Huazhong University of Science and Technology(华中科技大学) State Key Lab of General AI(通用人工智能国家重点实验室) Nat’l Eng. Research Center of Visual Technology(视觉技术国家工程研究中心) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京行为与心理健康重点实验室,北京大学) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,北京大学-武汉人工智能研究院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 UniAct通过统一感知与控制框架,实现人形机器人在多模态指令下的高效动作生成与实时执行,提升零样本跟踪成功率19%。

Comments Project page: https://jnnan.github.io/uniact/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24193 2026-01-01 cs.CV cs.AI 62%

PointRAFT: 3D deep learning for high-throughput prediction of potato tuber weight from partial point clouds

PointRAFT:用于从部分点云高通量预测马铃薯块茎重量的3D深度学习

Pieter M. Blok, Haozhou Wang, Hyun Kwon Suh, Peicheng Wang, James Burridge, Wei Guo

机构 * Graduate School of Agricultural and Life Sciences, The University of Tokyo(东京大学农业与生命科学研究生院) Department of Integrative Biological Sciences and Industry, Sejong University(世宗大学整合生物科学与工业系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 PointRAFT通过高通量点云回归网络,从部分点云直接预测马铃薯块茎重量,显著优于现有方法,适用于3D表型分析和机器人感知。

Comments 14 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03734 2026-01-01 cs.RO cs.CV 62%

OTTER: A Vision-Language-Action Model with Text-Aware Visual Feature Extraction

OTTER: 一种具有文本感知视觉特征提取的视觉-语言-动作模型

Huang Huang, Fangchen Liu, Letian Fu, Tingfan Wu, Mustafa Mukadam, Jitendra Malik, Ken Goldberg, Pieter Abbeel

机构 * University of California, Berkeley(加州大学伯克利分校) Meta AI

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 OTTER通过文本感知的视觉特征提取,提升视觉-语言-动作模型的零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24680 2026-01-01 cs.RO 57%

ReSPIRe: Informative and Reusable Belief Tree Search for Robot Probabilistic Search and Tracking in Unknown Environments

ReSPIRe: 信息性和可重用的信念树搜索用于未知环境中的机器人概率搜索与跟踪

Kangjie Zhou, Zhaoyang Li, Han Gao, Yao Su, Hangxin Liu, Junzhi Yu, Chang Liu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 ReSPIRe通过分层粒子结构和可重用信念树搜索,在未知环境中实现高效且稳定的机器人目标搜索与跟踪。

Comments 17 pages, 12 figures, accepted to IEEE Transactions on Systems, Man, and Cybernetics: Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23135 2026-01-01 cs.RO 57%

Beyond URDF: The Universal Robot Description Directory for Shared, Extensible, and Standardized Robot Models

超越URDF:通用机器人描述目录用于共享、可扩展和标准化的机器人模型

Roshan Klein-Seetharaman, Daniel Rakita

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出URDD,一种模块化机器人描述目录,通过自动化生成和标准化,提升机器人模型的共享与扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07345 2026-01-01 cs.RO 57%

Reproducibility in the Control of Autonomous Mobility-on-Demand Systems

自动驾驶按需出行系统中的可重复性

Xinling Li, Meshal Alharbi, Daniele Gammelli, James Harrison, Filipe Rodrigues, Maximilian Schiffer, Marco Pavone, Emilio Frazzoli, Jinhua Zhao, Gioele Zardini

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文系统研究了自动驾驶按需出行系统中可重复性问题,提出评估和改进可重复性的结构化框架及具体指南。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20676 2026-01-01 cs.CV 57%

SciceVPR: Stable Cross-Image Correlation Enhanced Model for Visual Place Recognition

SciceVPR: 稳定跨图像相关性增强模型用于视觉位置识别

Shanshan Wan, Yingmei Wei, Lai Kang, Tianrui Shen, Haixuan Wang, Yee-Hong Yang

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 SciceVPR通过增强跨图像相关性,提升视觉位置识别的稳定性和性能,优于现有单阶段和两阶段方法。

Comments This work has been accepted by Neurocomputing. The final version can be accessed via https://www.sciencedirect.com/science/article/pii/S0925231225032114

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03987 2026-01-01 eess.SP 56%

An Efficient Detector for Faulty GNSS Measurements Detection With Non-Gaussian Noises

一种用于非高斯噪声下的故障GNSS测量检测的高效检测器

Penggao Yan, Baoshan Song, Xiao Xia, Weisong Wen, Li-Ta Hsu

专题命中 机器人数据与评测 :navigation(abstract,comments)

AI总结 本文提出了一种针对非高斯噪声的高效故障检测方法,该方法在保持计算效率的同时,实现了与现有方法相当的检测性能。

Comments Submitted to NAVIGATION, Journal of the Institute of Navigation

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他机器人 6 篇

2512.23103 2026-01-01 cs.RO 79%

APOLLO Blender: A Robotics Library for Visualization and Animation in Blender

APOLLO Blender: 一种用于Blender中可视化和动画的机器人库

Peter Messina, Daniel Rakita

专题命中 其他机器人 :robotics(title,abstract);分类 cs.RO

AI总结 APOLLO Blender是一个用于Blender的机器人可视化和动画库,提供简单接口和功能,帮助研究人员快速创建高质量的可视化内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12843 2026-01-01 cs.CV cs.AI 62%

SLTNet: Efficient Event-based Semantic Segmentation with Spike-driven Lightweight Transformer-based Networks

SLTNet: 面向事件感知语义分割的高效轻量级脉冲神经网络

Xianlei Long, Xiaxin Zhu, Fangming Guo, Wanyi Zhang, Qingyi Gu, Chao Chen, Fuqiang Gu

机构 * College of Computer Science, Chongqing University(重庆大学计算机学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 SLTNet通过脉冲驱动轻量级变压器网络实现高效事件感知语义分割,提升性能并降低能耗

Comments Accepted by IROS 2025 (2025 IEEE/RSJ International Conference on Intelligent Robots and Systems)

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24243 2026-01-01 cs.CV 57%

MambaSeg: Harnessing Mamba for Accurate and Efficient Image-Event Semantic Segmentation

MambaSeg: 利用Mamba实现准确且高效的图像事件语义分割

Fuqiang Gu, Yuanke Li, Xianlei Long, Kangping Ji, Chao Chen, Qingyi Gu, Zhenliang Ni

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 MambaSeg通过双分支框架和双维交互模块,实现高效准确的多模态语义分割,适用于快速运动和低光条件下的图像事件分割任务。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23140 2026-01-01 cs.RO 57%

A New Software Tool for Generating and Visualizing Robot Self-Collision Matrices

一种生成和可视化机器人自碰撞矩阵的新软件工具

Roshan Klein-Seetharama, Daniel Rakita

机构 * Roshan Klein-Seetharaman and Daniel Rakita(独立研究者)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种交互式工具,用于生成和可视化自碰撞矩阵,支持多种形状表示,提升机器人自碰撞检测的效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01980 2026-01-01 math.GT math.AT math.DS 50%

Approaches to critical point theory via sequential and parametrized topological complexity

通过序列和参数化拓扑复杂性研究临界点理论的方法

Stephan Mescher, Maximilian Stegemeyer

专题命中 其他机器人 :robotics(abstract)

AI总结 本文通过序列和参数化拓扑复杂性方法,研究临界点理论并建立相关下界,同时计算了特定流形的参数化拓扑复杂性。

Comments 38 pages, to appear in Topological Methods in Nonlinear Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14737 2026-01-01 cond-mat.mtrl-sci nlin.AO 50%

Unveiling dynamic bifurcation of Resch-patterned origami for self-adaptive impact mitigation structure

揭示Resch图案折纸的动态分叉行为用于自适应冲击缓解结构

Yasuhiro Miyazawa, Dahun Lee, Seonghyun Kim, Chia-Yung Chang, Qixun Li, Ryan Tenu Ahn, Minho Cha, Koshiro Yamaguchi, Yuyang Song, Shinnosuke Shimokawa, Umesh Gandhi, Jinkyu Yang

专题命中 其他机器人 :robotics(abstract)

AI总结 基于Resch图案折纸设计自适应冲击缓解结构,通过动态分叉行为实现多模式变形,提升能量耗散能力。

详情

展开后加载摘要…

URL PDF HTML 收藏