arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 61386 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22146 篇

1902.11104 2021-05-25 cs.RO cs.LG 77%

Tensor-variate Mixture of Experts for Proportional Myographic Control of a Robotic Hand

Noémie Jaquier, Robert Haschke, Sylvain Calinon

专题命中 机器人操作 :robotic(title);分类 cs.RO、cs.LG;robotics(comments)

Comments Accepted for publication in Robotics and Autonomous Systems (RAS). Code and video available at: https://sites.google.com/view/tensor-mixture-of-experts/ . 14 pages, 10 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.08209 2019-08-23 cs.RO cs.CV 77%

BIM-assisted object recognition for the on-site autonomous robotic assembly of discrete structures

Mohamed Dawod, Sean Hanna

专题命中 机器人操作 :robotic(title);分类 cs.RO、cs.CV;robotics(journal_ref)

Journal ref Construction Robotics, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26076 2026-08-27 cs.RO 新提交 77%

Fast Generative Grasping via Lie Group-Constrained MeanFlow

基于李群约束MeanFlow的快速生成式抓取

S. Talha Bukhari, Yi Wei, Ruiqi Ni, Zachary Kingston, Aniket Bera

机构 * Purdue University(普渡大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究提出基于李群约束MeanFlow的快速生成式抓取方法,可在≤5次网络评估内采样可靠抓取,在ACRONYM数据集上性能与SOTA模型相当,推理延迟达毫秒级,且无需额外训练即可迁移到真实机器人抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15440 2026-08-18 cs.RO 新提交 77%

Accelerating Mixed Discrete-Continuous Motion Planning via Neural Graphs of Convex Sets

通过凸集神经图加速混合离散-连续运动规划

Ananya Trivedi, Sarvesh Prajapati, Mohamed Khalid M Jaffar, Zhexin Xu, David Rosen, Taskin Padir

机构 * Northeastern University(东北大学) University of Maryland(马里兰大学) Amazon(亚马逊公司)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究针对混合离散-连续运动规划的计算瓶颈,提出基于图注意力网络的凸集神经图策略,实现最高两个数量级加速且保持100%成功率,适用于多种机器人任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07075 2026-08-10 cs.RO 新提交 77%

Detection and Ranging of Transient Extrinsic Contacts Based on 6D Dynamic Tactile Sensing

基于6D动态触觉感知的瞬态外部接触检测与测距

Haowen Zheng, Yinghao Wu, Fuyuan Liu, Yichen Li, Yitian Shao

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出TECDAR方法,通过6D动态触觉传感结合扩展卡尔曼滤波器,实现瞬态外部接触的快速精准定位,平均精度约7 mm,可用于机器人精细操作等场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29569 2026-08-03 cs.RO cs.SY eess.SY 新提交 77%

Safe Vision Language Action Models via Barrier Enhanced Flow Matching

基于障碍增强流匹配的安全视觉语言动作模型

Kasra Sinaei, Hung-Chieh Wu, Donald Ebeigbe

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究提出将流匹配生成模型与控制障碍函数安全保证结合的模块化推理框架,通过修改流匹配去噪过程实现本质安全,在不降低模型成功率的前提下完成安全验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28625 2026-07-31 cs.CV 新提交 77%

ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine

ACE-Data-0:以人为中心的环境捕获作为具身数据引擎

Yukang Cao, Haozhe Xie, Beichen Wen, Runmao Yao, Yinghao Liu, Yue Huang, Zhichao Liao, Yunxiang Wang, Haiheng Liu, Xingshun Tian, Dawei Su, Long Zhuo, Dacheng Tao, Xiaogang Wang, Liang Pan, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab) ACE Robotics(ACE机器人公司)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);world model(abstract);分类 cs.CV

AI总结 本研究提出以人为中心的具身数据引擎ACE,构建含150小时数据的ACE-Data-0数据集,引入分层基准,暴露现有方法缺陷,为具身AI等领域提供基础。

Comments Project Page: https://ace-data-engine.github.io/ACE-Data-0/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22964 2026-07-28 cs.RO cs.HC 新提交 77%

Pose-Aware Modeling to Mitigate Pose-Related Artifacts in Tactile Gloves

用于减轻触觉手套中与姿势相关伪像的姿势感知建模

Tianhong Catherine Yu, Ziyi Kou, Mia Huang, Taylor Niehues, Yiyue Luo, Li Guan, Dingtian Zhang

机构 * Cornell Univeristy(康奈尔大学) Meta Reality Labs(Meta 现实实验室) University of Washington(华盛顿大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对触觉手套因手部姿势变化产生伪像致最小可检测力提高的问题,引入无需修改手套的算法框架,利用姿势信息减轻伪像,经多手套设计和用户验证,有效降低了最小可检测力,提升了手套在相关应用中的可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18950 2026-07-22 cs.RO 新提交 77%

Design and stability analysis of an underactuated hand with passively rotating fingers

具有被动旋转手指的欠驱动手的设计与稳定性分析

Léonie Plancoulaine, Sylvain Guégan, Franck Plestan, Damien Chablat

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究具有空间移动性的欠驱动机器人手指,通过创新设计简化运动复杂性,引入稳定性标准和差动机构,经实验验证理论结果,降低了机械复杂性等,推动了柔顺机器人手发展,为未来自主操作研究奠定基础。

Journal ref Proceedings of the ASME 2026 International Design Engineering Technical Conferences \& Computers and Information in Engineering Conference, ASME, Aug 2026, Houston, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16805 2026-07-21 cs.CV 新提交 77%

Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning

Scene-SAM3D:无需微调的多视图场景资产生成

Yuqi Zhang, Yadan Luo, Xiangyu Sun, Fengyi Zhang, Zi Huang, Xin Tan

机构 * The University of Queensland(昆士兰大学) East China Normal University(华东师范大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 研究针对现实场景中3D生成难题,提出无需训练的Scene-SAM3D框架,通过选互补视图、潜在速度融合及高斯优化,实现多视图场景资产生成,实验证明其在减少场景级CD和降低计算成本上有显著成效。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06570 2026-07-21 cs.RO 版本更新 77%

Unsupervised Discovery of Failure Taxonomies from Deployment Logs

无监督发现部署日志中的故障分类

Aryaman Gupta, Yusuf Umut Ciftci, Somil Bansal

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出无监督发现部署日志中的故障分类方法,通过视觉-语言推理和语义聚类,提升机器人系统鲁棒性和故障监控能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16187 2026-07-20 cs.RO 新提交 77%

Handroid: Bridging Dexterous Hand and Humanoid

Handroid:连接灵巧手与人形机器人

Ruogu Li, Chenyang Ma, Sikai Li, Zhenyu Wei, Yunchao Yao, Haochen Shi, C. Karen Liu, Shuran Song, Mingyu Ding

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Stanford University(斯坦福大学)

专题命中 机器人操作 :robotics(abstract);robot learning(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究旨在开发兼具灵巧手与拟人机器人功能的平台,提出Handroid,它能在单一可重构平台集成两种能力,有统一控制学习框架,经多种任务验证,成为推进形态可重构机器人技术及跨实体学习的紧凑可复制平台。

Comments Project website: https://handroid.org

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03129 2026-07-13 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 77%

GraphSeg: Segmented 3D Representations via Graph Edge Addition and Contraction

GraphSeg: 通过图边添加和收缩实现分段3D表示

Haozhan Tang, Tianyi Zhang, Oliver Kroemer, Matthew Johnson-Roberson, Weiming Zhi

机构 * Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 GraphSeg通过图边添加和收缩实现高效的3D对象分割,提升机器人环境下的分割精度和一致性。

Journal ref Proceedings of the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04426 2026-07-07 cs.RO 新提交 77%

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI

ACE-Brain-0.5:用于物理智能体人工智能的统一具身基础模型

Brain Team, Ziyang Gong, Haoming Gu, Zehang Luo, Tianyi Zhang, Tao Tao, Yixiao Chi, Zhe Liu, Lingsi Zhu, Jingyuan Liu, Anke Tang, Songze Li, Yilun Kong, Ningjing Liu, Tianyu Zhu, Yunpeng Qing, Shuang Luo, Xiang Liu, Shi Fu, Dawei Nie, Sixiang Liu, Zhexi Wen, Feng Pan, Xiaofeng Wang, Zhi Hou, Chunxiao Liu, Xue Yang, Junchi Yan, Hengshuang Zhao, Dacheng Tao, Xiaogang Wang

机构 * ACE-Brain Team(ACE-Brain团队)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 研究针对具身人工智能从模块向物理智能体发展的问题,提出ACE-Brain-0.5统一基础模型,通过耦合的五个功能及SSR+等方法,提升空间感知等能力,在多基准测试中有进步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30988 2026-07-07 cs.RO 新提交 77%

Multisensory Continual Learning: Adapting Pretrained Visuomotor Policies to Force

多感官持续学习:将预训练的视觉运动策略适应到力觉

Jaden Clark, Changhao Wang, Yihuai Gao, Seongheon Hong, Hojung Choi, Mark Cutkosky, Yifan Hou, Shuran Song

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robot policy(abstract);分类 cs.RO

AI总结 提出MuSe方法,通过多阶段融合、多感官未来预测和预训练数据经验回放,将有限的多感官数据融入预训练的纯视觉策略,在保持原始任务性能的同时适应新任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03283 2026-07-07 cs.CV 版本更新 77%

Utonia: Toward One Encoder for All Point Clouds

Utonia:迈向适用于所有点云的单一编码器

Yujia Zhang, Xiaoyang Wu, Yunhan Yang, Xianzhe Fan, Han Li, Yuechen Zhang, Zehao Huang, Naiyan Wang, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Xiaomi(小米)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 研究旨在训练跨多领域的单自监督点变压器编码器Utonia,其能学习一致表征空间实现跨域转移,统一各领域点云,提升感知能力,还对具身和多模态推理有益,有望成为稀疏3D数据基础模型。

Comments produced by Pointcept, project page: https://pointcept.github.io/Utonia

Journal ref International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23431 2026-06-23 cs.RO 新提交 77%

DexTeleop-0: Force-Aware Bimanual Dexterous Teleoperation with Ego-Centric Perception towards Shared Autonomy

DexTeleop-0: 面向共享自主的力感知双臂灵巧遥操作与自我中心感知

Haichao Liu, Yuyao Jiang, Hyunsun Park, Yuanjiang Xue, Ziwei Wang

机构 * Nanyang Technological University, Singapore(新加坡南洋理工大学) OOJU, USA(美国OOJU)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对接触丰富任务中遥操作精度低的问题,提出基于触觉驱动的自适应策略,通过实时优化循环将粗略人类意图转化为精确力控机器人命令,显著提升任务成功率与执行效率。

Comments 15 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21088 2026-06-23 cs.RO 新提交 77%

MV-WAM: Manifold-Aware World Action Model with Value Augmentation

MV-WAM: 具有价值增强的流形感知世界动作模型

Jintao Chen, Peidong Jia, Qingpo Wuwu, Jiaming Liu, Mengfei Du, Chun-Kai Fan, Xiaowei Chi, Hao Chen, Chengyu Bai, Zezhong Qian, Hao Wang, Jiajun Cao, Weishi Mi, Xiaozhu Ju, Jian Tang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出MV-WAM框架,通过跨模态因果掩码、流形感知优化和进度价值调节机制,联合建模视觉预测、动作生成和价值估计,在分布外场景中提升动作泛化能力,在仿真和真实机器人任务上显著优于基线。

Comments 20 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17418 2026-06-17 cs.RO 新提交 77%

DexLink Hand: A Compact, Affordable, 16-DOF Linkage-Driven Hand with Human-Like Dexterity

DexLink Hand:一款紧凑、经济、16自由度连杆驱动且具有类人灵巧性的手部

Hao Wu, Yanzhe Wang, Yu Feng, Jian Liu, Jihao Li, Jianshu Zhou, Huixu Dong

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种紧凑、低成本的连杆驱动仿人手,通过混合平面与空间连杆机构实现16个独立驱动、20个关节的高灵巧性,重320g、成本低于400美元,达到最大Kapandji评分并复现全部33种Feix抓取类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00836 2026-06-16 cs.RO 版本更新 77%

One-Step Model Predictive Path Integral for Manipulator Motion Planning Using Configuration Space Distance Fields

基于构型空间距离场的一步模型预测路径积分用于机械臂运动规划

Yulin Li, Tetsuro Miyazaki, Kenji Kawashima

机构 * Department of Information Physics and Computing, The University of Tokyo(东京大学信息物理与计算系)

专题命中 机器人操作 :robotics(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出将构型空间距离场与模型预测路径积分结合,利用CDF梯度统一代价函数并缩短规划时域至一步,实现高效避障,在2D环境和7自由度机械臂仿真中成功率近100%,控制频率超750Hz。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08213 2026-06-10 cs.RO 版本更新 77%

HandCept: A Visual-Inertial Fusion Framework for Accurate Proprioception in Dexterous Hands

HandCept: 用于灵巧手精确本体感知的视觉-惯性融合框架

Huang Junda, Honghao Guo, Hao Wu, Zhengyang Liu, Marcelo H Ang, Jianshu Zhou

机构 * The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出HandCept,首个视觉-惯性本体感知框架,通过零样本学习和无延迟扩展卡尔曼滤波融合腕部RGB-D相机与9轴IMU,实现2°-4°关节角估计误差且无漂移,优于纯视觉或纯惯性方法。

Comments 8 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.08280 2026-06-04 cs.RO cs.SY eess.SY 77%

Extrinisic Calibration of a Camera-Arm System Through Rotation Identification

通过旋转识别进行相机-机械臂系统的外校准

Steve McGuire, Christoffer Heckman, Daniel Szafir, Simon Julier, Nisar Ahmed

机构 * Department of Aerospace Engineering Sciences, University of Colorado at Boulder(科罗拉多大学波尔德分校航空航天工程科学系)

专题命中 机器人操作 :robotics(abstract);world model(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于观察臂的结构运动来恢复外校准参数的方法,结合已知的机械臂运动学和图像平面中的二次曲线观测,通过最大似然估计计算校准外参数,该方法在仿真中得到验证并在现实模型中测试,结果与尺子估计一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01777 2026-06-02 cs.RO 77%

Trans2Occ: Voxel Occupancy Estimation and Grasp for Transparent Objects from Simulation to Reality

Trans2Occ: 从仿真到现实的透明物体体素占用估计与抓取

Yixuan Yang, Sha Zhang, Rui Li, Zhenfei Yin, Xinzhu Ma, Yiran Qin, Lei Bai, Xudong Xu, Shilin Shan, Wangmeng Zuo, Yanyong Zhang, Wanli Ouyang, Feng Zheng, Shixiang Tang, Dongzhan Zhou

机构 * Shanghai AI Laboratory(上海人工智能实验室) SUSTech(南方科技大学) CUHK(香港中文大学) Harbin Institute of Technology(哈尔滨工业大学) University of Oxford(牛津大学) Beihang University(北京航空航天大学) Nanyang Technological University(南洋理工大学) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出基于单视图RGB输入的体素占用预测框架,结合仿真数据生成与规则抓取策略,实现透明物体的鲁棒3D感知与操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31352 2026-06-01 cs.RO 77%

Haptic Sorter: A Unified Planning Framework for Online Shape Estimation and Real-Time Pose Inference

Haptic Sorter: 一种用于在线形状估计和实时位姿推断的统一规划框架

Zhuoyi Lu, Lin Yang, Sri Harsha Turlapati, Domenico Campolo

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University (NTU), Singapore(南洋理工大学机械与航空航天工程学院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种基于模型的统一几何框架,结合贝叶斯优化引导的触觉探索、超椭圆形状近似、操作势能自适应公式以及在线常微分方程实时位姿推断,用于机器人操作中的形状估计和位姿跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28368 2026-05-29 cs.LG cond-mat.mtrl-sci physics.app-ph 77%

LEIA: Learned Environment for Interactive Architected Materials

LEIA: 用于交互式架构材料的学习环境

Haiqian Yang, Yuan Cao, Markus J. Buehler

机构 * Unreasonable Labs

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.LG

AI总结 提出LEIA世界模型,通过逐步施加边界条件并实时观察变形和应力场,支持工程师交互式探索架构材料,并实现快速代理引导的候选生成与排序。

Comments 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27643 2026-05-28 cs.RO physics.optics 77%

Agentic Language-to-Objective Synthesis for Optofluidic Assembly

面向光流组件的智能语言到目标合成

Ivan Saraev, Elena Erben, Weida Liao, Fan Nan, Gerhard Neumann, Eric Lauga, Moritz Kreysing

机构 * Institute of Biological and Chemical Systems, Karlsruhe Institute of Technology, Germany(马克斯·普朗克研究所生物和化学系统研究所,卡尔斯鲁厄技术大学,德国) Department of Applied Mathematics and Theoretical Physics, University of Cambridge, UK(应用数学和理论物理系,剑桥大学,英国) Department of Mathematics, Imperial College London, UK(数学系,伦敦帝国理工学院,英国) Institute of Anthropomatics and Robotics (IAR), Karlsruhe Institute of Technology, Germany(人机学与机器人研究所(IAR),卡尔斯鲁厄技术大学,德国)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出Speak-to-Objective模块化智能流水线,利用条件大语言模型将口语或书面指令转换为可微目标函数,实现光流控微粒子组装,并支持用户反馈学习。

Comments 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18384 2026-05-27 cs.RO cs.FL 77%

LAD-VF: LLM-Automatic Differentiation Enables Fine-Tuning-Free Robot Planning from Formal Methods Feedback

LAD-VF:LLM自动微分实现基于形式化方法反馈的无微调机器人规划

Yunhao Yang, Junyuan Hong, Gabriel Jacob Perin, Zhiwen Fan, Li Yin, Zhangyang Wang, Ufuk Topcu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of São Paulo(圣保罗大学) Texas A&M University(德克萨斯A&M大学) SylphAI

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 提出LAD-VF框架,利用形式化验证反馈和LLM自动微分自动优化提示词,无需微调即可提升机器人规划任务中规范符合率,成功率从60%提升至90%以上。

Comments Presented at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23203 2026-05-25 cs.CV cs.AI cs.LG cs.RO 77%

Lipschitz Optimization for Formal Verification of Homographies

单应性矩阵形式化验证的Lipschitz优化

Jean-Guillaume Durand, Panagiotis Kouvaros, Maxime Gariel, Alessio Lomuscio

机构 * Joby Aviation(Joby航空) Safe Intelligence

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出一种利用Lipschitz优化和分段连续性对单应性矩阵进行形式化验证的方法,首次实现对投影几何变换的鲁棒性验证,在基准测试中取得最高89%加速和7%更紧的边界。

Comments 18 pages, 13 figures, 6 tables, to be published at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20811 2026-05-21 cs.RO 77%

Demo-JEPA: Joint-Embedding Predictive Architecture for One-shot Cross-Embodiment Imitation

Demo-JEPA: 一种用于单次跨体态模仿的联合嵌入预测架构

Jingyang He, Guangrun Li, Jieyu Zhang, Chengkai Hou, Zhengping Che, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息处理国家重点实验室,计算机学院,北京大学) University of Washington(华盛顿大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出Demo-JEPA,一种跨体态模仿框架,通过解耦示范意图与体态特定的执行,利用共享预测表示空间将源视觉示范转换为目标兼容的未来潜在轨迹,使目标代理通过规划实现这些子目标,从而在异构体态间实现灵活的模仿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19587 2026-05-20 cs.AI 77%

SceneCode: Executable World Programs for Editable Indoor Scenes with Articulated Objects

SceneCode: 可执行的世界程序用于可编辑的室内场景及具有关节物体

Puyi Wang, Yuhao Wang, Linjie Li, Zhengyuan Yang, Kevin Qinghong Lin, Yangguang Li, Yu Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Microsoft(微软) University of Oxford(牛津大学)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);robotic(abstract);分类 cs.AI

AI总结 本文提出SceneCode,一种通过可执行程序生成可编辑的室内场景,解决了现有方法中物体结构控制不足的问题,提升了场景生成的精确性和可交互性。

详情

展开后加载摘要…

URL PDF HTML 收藏