arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-06 至 2026-04-06 共收录 49 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 17 篇

2604.02749 2026-04-06 eess.SY cs.SY 50%

Residual-Aware Distributionally Robust EKF: Absorbing Linearization Mismatch via Wasserstein Ambiguity

残差感知的分布鲁棒扩展卡尔曼滤波:通过瓦瑟斯坦模糊性吸收线性化不匹配

Minhyuk Jang, Jungjin Lee, Astghik Hakobyan, Naira Hovakimyan, Insoon Yang

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种残差感知的分布鲁棒扩展卡尔曼滤波,通过瓦瑟斯坦模糊性框架同时解决噪声模型不匹配和线性化误差问题,提供可计算的有效半径和确定性误差界。

Comments Submitted to the 2026 65th IEEE Conference on Decision and Control (CDC)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 3 篇

2603.29585 2026-04-06 cs.GR cs.AI 83%

Learn2Fold: Structured Origami Generation with World Model Planning

Learn2Fold: 基于世界模型规划的结构化折纸生成

Yanjia Huang, Yunuo Chen, Ying Jiang, Jinru Han, Zhengzhong Tu, Yin Yang, Chenfanfu Jiang

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.AI

AI总结 本文提出Learn2Fold框架,通过结合符号推理与物理模拟,解决从文本生成物理有效的折纸折叠序列问题。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03144 2026-04-06 cs.AR cs.AI cs.CL 79%

InCoder-32B-Thinking: Industrial Code World Model for Thinking

InCoder-32B-Thinking:工业代码世界模型用于推理

Jian Yang, Wei Zhang, Jiajun Wu, Junhang Cheng, Tuney Zheng, Fanglin Xu, Weicheng Gu, Lin Jing, Yaxin Du, Joseph Li, Yizhi Li, Yan Xing, Chuan Hao, Ran Tao, Ruihao Gong, Aishan Liu, Zhoujun Li, Mingjie Tang, Chenghua Lin, Siheng Chen, Wayne Xin Zhao, Xianglong Liu, Ming Zhou, Bryan Dai, Weifeng Lv

机构 * Beihang University(北京航空航天大学) IQuest Research Shanghai Jiao Tong University(上海交通大学) ELLIS University of Manchester(曼彻斯特大学) Sichuan University(四川大学) Langboat(朗博特)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 本文提出InCoder-32B-Thinking,通过工业代码世界模型生成推理轨迹,评估显示其在通用和工业基准上均取得领先开源结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02580 2026-04-06 cs.LG 79%

VoxelCodeBench: Benchmarking 3D World Modeling Through Code Generation

VoxelCodeBench:通过代码生成进行3D世界建模的基准测试

Yan Zheng, Florian Bordes

机构 * FAIR at Meta(Meta FAIR) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 具身推理 :world model(title);manipulation(abstract);分类 cs.LG

AI总结 本文提出VoxelCodeBench基准,通过代码生成评估3D空间推理能力,发现生成可执行代码易,但生成空间正确输出难,尤其在几何构造和多物体组合上挑战大。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 1 篇

2604.02965 2026-04-06 cs.RO cs.CL 57%

Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA

开环规划,闭环验证:VLA的推测验证

Zihua Wang, Zhitao Lin, Ruibo Li, Yu Zhang, Xu Yang, Siya Mi, Xiu-Shen Wei

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Nanyang Technological University(南洋理工大学) School of Cyber Science and Engineering, Southeast University(东南大学网络空间安全学院) Purple Mountain Laboratories(紫金山实验室)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 本文提出SV-VLA框架,结合高效开环长周期规划与轻量闭环在线验证,提升VLA在动态环境中的效率与可靠性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 5 篇

2511.15279 2026-04-06 cs.RO cs.CV 84%

Look, Zoom, Understand: The Robotic Eyeball for Embodied Perception

看、聚焦、理解:用于具身感知的机器人眼球

Jiashu Yang, Yifan Han, Yucheng Xie, Ning Guo, Wenzhao Lian

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Dalian University of Technology(大连理工大学)

专题命中 模仿学习与强化学习 :robotic(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文提出EyeVLA框架,通过整合视觉感知、语言理解和物理摄像头控制,实现语言引导的主动视觉感知。该框架在500个真实样本上训练,使机器人在50种不同场景中完成任务的平均完成率为96%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02686 2026-04-06 cs.LG cs.AI 76%

Beyond Semantic Manipulation: Token-Space Attacks on Reward Models

超越语义操控:奖励模型中的标记空间攻击

Yuheng Zhang, Mingyue Huo, Minghao Zhu, Mengxue Zhang, Nan Jiang

机构 * UIUC(伊利诺伊大学厄巴纳-香槟分校) Independent Researcher(独立研究员) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 模仿学习与强化学习 :manipulation(title);分类 cs.AI、cs.LG

AI总结 本文提出Token Mapping Perturbation Attack(TOMPA)框架,通过在标记空间中进行对抗优化,发现非语言标记模式以提升奖励模型性能,揭示了当前RLHF流程的关键漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04356 2026-04-06 math.OC cs.AI cs.RO 62%

Mission-Aligned Learning-Informed Control of Autonomous Systems: Formulation and Foundations

任务对齐的学习引导控制:公式与基础

Vyacheslav Kungurtsev, Monicah Cherop Naibei, Gustav Sir, Akhil Anand, Sebastien Gros, Haozhe Tian, Homayoun Hamedmoghadam

机构 * Czech Technical University in Prague(捷克布拉格工业大学) Norwegian University of Science and Technology(挪威科技大学) Imperial College London(伦敦帝国理工学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种任务对齐的学习引导控制框架,结合控制、经典规划和强化学习,提升自主系统安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03023 2026-04-06 cs.RO 57%

Behavior-Constrained Reinforcement Learning with Receding-Horizon Credit Assignment for High-Performance Control

具有递推地 horizon 信用分配的行为约束强化学习

Siwei Ju, Jan Tauberschmidt, Oleg Arenz, Peter van Vliet, Jan Peters

机构 * TU Darmstadt(达姆施塔特工业大学) Porsche AG(保时捷股份公司) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种行为约束强化学习框架,通过递推地 horizon 预测机制和参考轨迹条件化策略,实现超越演示并保持专家行为一致的高性能控制策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02348 2026-04-06 cs.LG 57%

Contextual Intelligence The Next Leap for Reinforcement Learning

情境智能:强化学习的下一步

André Biedenkapp

机构 * Albert-Ludwigs-Universität(弗莱堡大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

AI总结 本文提出情境智能的新框架,通过区分环境驱动和代理驱动因素,探索异构情境学习、多时间尺度建模和抽象高层情境整合,以提升强化学习的泛化能力与现实应用效率。

Comments Accepted to AAMAS 2025 (Blue Sky Ideas Track)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 6 篇

2604.02759 2026-04-06 cs.RO 70%

OMNI-PoseX: A Fast Vision Model for 6D Object Pose Estimation in Embodied Tasks

OMNI-PoseX:一种用于具身任务中6D物体姿态估计的高效视觉模型

Michael Zhang, Wei Ying, Fangwen Chen, Shifeng Bai, Hanwen Kang

机构 * KernalMind Tech Co., Ltd.(KernalMind科技有限公司)

专题命中 机器人数据与评测 :embodied agent(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出OMNI-PoseX,一种结合开放词汇感知与SO(3)感知的高效视觉模型,通过轻量级多模态融合策略实现稳定且高效的6D姿态估计,并在多个基准测试中展示了SOTA的精度和实时性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16672 2026-04-06 cs.CV 70%

ReWeaver: Towards Simulation-Ready and Topology-Accurate Garment Reconstruction

ReWeaver:面向仿真准备和拓扑准确的服装重建

Ming Li, Hui Shan, Kai Zheng, Chentao Shen, Siyu Liu, Yanwei Fu, Zhen Chen, Xiangru Huang

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Fudan University(复旦大学) Adobe Xidian University(西安电子科技大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 ReWeaver通过稀疏多视角图像实现拓扑准确的3D服装和缝纫图案重建,提升仿真和机器人应用的精度与一致性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02639 2026-04-06 cs.CV cs.AI 62%

Cross-Vehicle 3D Geometric Consistency for Self-Supervised Surround Depth Estimation on Articulated Vehicles

跨车辆3D几何一致性用于机械臂车辆上的自监督周围深度估计

Weimin Liu, Jiyuan Qiu, Wenjun Wang, Joshua H. Meng

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) Remote Sensing and Earth Observation Laboratory, University of Copenhagen(哥本哈根大学遥感与地球观测实验室) California PATH, University of California, Berkeley(加州大学伯克利分校加州PATH)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本文提出ArticuSurDepth框架,通过跨视图和跨车辆几何一致性提升机械臂车辆周围深度估计的结构一致性与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02911 2026-04-06 cs.RO 61%

Learning Task-Invariant Properties via Dreamer: Enabling Efficient Policy Transfer for Quadruped Robots

通过Dreamer学习任务不变属性:为四足机器人实现高效的策略迁移

Junyang Liang, Yuxuan Liu, Yabin Chang, Junfan Lin, Junkai Ji, Hui Li, Changxin Huang, Jianqiang Li

机构 * Shenzhen University(深圳大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出DreamTIP框架,通过在Dreamer世界模型中引入任务不变属性学习,提升仿真到现实的迁移能力,实验表明其在复杂地形任务中表现优异,性能提升显著。

Comments Accepted by IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02586 2026-04-06 cs.CV cs.GR 57%

TrackerSplat: Exploiting Point Tracking for Fast and Robust Dynamic 3D Gaussians Reconstruction

TrackerSplat:利用点跟踪实现快速且鲁棒的动态3D高斯重建

Daheng Yin, Isaac Ding, Yili Jin, Jianxin Shi, Jiangchuan Liu

机构 * Simon Fraser University(西蒙弗雷泽大学) McGill University(麦吉尔大学) Nankai University(南开大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 TrackerSplat通过整合先进点跟踪方法,提升动态场景重建中3D高斯的鲁棒性和可扩展性,有效减少大位移导致的失真和时间不一致问题,实现高吞吐量与高质量重建。

Comments 11 pages, 6 figures

Journal ref SA Conference Papers '25: Proceedings of the SIGGRAPH Asia 2025 Conference Papers Article No.: 71, Pages 1 - 11

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17266 2026-04-06 cs.RO 57%

Simulation of Active Soft Nets for Capture of Space Debris

主动软网的模拟用于空间碎片的捕获

Leone Costi, Dario Izzo

机构 * European Space Agency(欧洲航天局)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于MuJoCo的模拟器,用于设计和控制软机器人网自主清除空间碎片。研究不同机械模型和控制策略,展示软网在捕获Envisat时的高适应性与成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他机器人 3 篇

2604.03006 2026-04-06 cs.RO 57%

A Flow Matching Framework for Soft-Robot Inverse Dynamics

一种用于软机器人逆动力学的流匹配框架

Hang Yang, Fangju Yang, Yangming Zhang, Ibrahim Alsarraj, Yuhao Wang, Zhenye Luo, Zixi Chen, Ke Wu

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种流匹配框架,用于学习软连续机器人的逆动力学,通过生成运输映射实现系统微分动力学的学习,提升轨迹跟踪精度和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02609 2026-04-06 cs.RO 57%

Elastomeric Strain Limitation for Design of Soft Pneumatic Actuators

弹性形变限制在软气动执行器设计中的应用

Gregory M. Campbell

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文研究了用于安全力生成的软气动执行器设计,通过电吸附(EA)限位器实现形状变化、快速力施加和精确充气轨迹控制,展示了在相同压力扫描下可变轨迹充气的应用。

Comments PhD Thesis, University of Pennsylvania, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10722 2026-04-06 cs.RO cs.DC cs.SE 57%

A Survey of Real-Time Support, Analysis, and Advancements in ROS 2

ROS 2实时支持、分析与进展综述

Daniel Casini, Jian-Jia Chen, Jing Li, Federico Reghenzani, Harun Teper

机构 * Scuola Superiore Sant’Anna, Pisa, Italy(意大利比萨圣安娜大学) TU Dortmund University, Germany(德国多特蒙德工业大学) New Jersey Institute of Technology, Newark, USA(美国新泽西理工学院) Politecnico di Milano, Milan, Italy(意大利米兰理工大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文综述了ROS 2在实时系统中的研究进展,涵盖调度机制、通信中间件、执行器分析及社区改进,提出分类体系以指导实时能力提升。

详情

展开后加载摘要…

URL PDF HTML 收藏