arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 22110 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22110 篇

1710.11088 2026-06-04 cs.RO cs.SY eess.SY 83%

Robust Cooperative Manipulation without Force/Torque Measurements: Control Design and Experiments

无需力/扭矩测量的鲁棒协同操作:控制设计与实验

Christos K. Verginis, Matteo Mastellaro, Dimos V. Dimarogonas

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出两种新型控制方法,用于由N个机器人代理协同操作物体,通过四元数反馈避免表示奇异,同时保证物体轨迹的暂态和稳态性能,且具有去中心化和抗扰动特性,无需力/扭矩测量,并通过仿真和实验验证理论结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.01426 2026-06-04 cs.RO cs.SY eess.SY 83%

A Nonlinear Model Predictive Control Scheme for Cooperative Manipulation with Singularity and Collision Avoidance

一种用于协同操作的非线性模型预测控制方案,包含奇异性和避障

Alexandros Nikou, Christos Verginis, Shahab Heshmati-alamdari, Dimos V. Dimarogonas

专题命中 机器人操作 :manipulation(title);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种非线性模型预测控制方案,用于在存在障碍物的有限工作空间中安全导航被N个机器人代理抓取的物体,同时避免碰撞和奇异配置。

Comments Simulation results with 3 agents added

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00966 2026-06-02 cs.RO 83%

Threading Optimization for Vision-Language-Action Model Inference in Low-Cost Smart Agricultural Manipulation

低成本智能农业机械臂中视觉-语言-动作模型推理的线程优化

Keith Truongcao, Christopher Nhu, Zijian An, Phong Nguyen, Siwei Cai, Lifeng Zhou

机构 * Department of Electrical Engineering, Drexel University(德雷塞尔大学电气工程系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对低成本机械臂上VLA模型推理慢、精细动作调整难的问题,通过优化RTAC算法的线程实现,降低了端到端延迟并提高了响应性,在农产品操作任务中验证了控制稳定性和速度的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00576 2026-06-02 cs.RO 83%

Dynamic Resilient Spatio-Semantic Memory with Hybrid Localization for Mobile Manipulation

面向移动操作的动态弹性时空语义记忆与混合定位

Zhijie Yan, Shufei Li, Ze Zhang, Xin Liu, Yuhang Zheng, Zuoxu Wang

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院) Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出DREAM框架,通过在线构建时空语义体素记忆、冗余感知记忆剪枝和混合定位,实现无预建地图的动态室内移动操作,将长时任务成功率提升至55%-70%。

Comments Code, CAD model, and real-robot demonstrations are available at https://bjhyzj.github.io/dream-web

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00449 2026-06-02 cs.RO 83%

ROG-Grasp: Root-Oriented Geometry for Robotic Grasping and Placement

ROG-Grasp:面向根部的几何方法用于机器人抓取与放置

Zijian An, Augustus Sroka, Ran Yang, Bill Cai, Satoru Eto, Brian Poon, Kelvin Cai, Shijie Geng, Feng Liu, Yiming Feng, Lifeng Zhou

机构 * Department of Electrical and Computer Engineering, Drexel University(德雷塞尔大学电气与计算机工程系) Virginia Seafood Agricultural Research and Extension Center, and Department of Biological Systems Engineering, Virginia Tech(弗吉尼亚理工学院生物系统工程系和弗吉尼亚海鲜农业研究与推广中心) Amazon Store Foundation AI (SFAI)(亚马逊商店基金会人工智能(SFAI))

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出基于根部表面几何的ROG-Grasp框架,通过RGB-D感知估计农产品朝向,结合YOLO检测器和点云平面拟合生成稳定抓取姿态,在番茄和洋葱实验中实现高成功率与快速执行。

Comments Comments: 7 pages, 6 figures. Video: https://youtu.be/Ir2UtGODdMo

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14143 2026-06-02 cs.RO 83%

CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping

CLAW: 一种面向重量感知机器人抓取的视觉-语言-动作框架

Zijian An, Ran Yang, Yiming Feng, Lifeng Zhou

机构 * Department of Electrical and Computer Engineering, Drexel University(德雷塞尔大学电气与计算机工程系)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出CLAW框架,通过解耦条件评估与动作生成,利用微调CLIP模型监控重量阈值并生成提示,结合流式VLA策略实现重量感知的机器人抓取,在单目标与双目标实验中优于基线模型。

Comments 8 pages, 5 figures, Video: https://youtu.be/MuMYj2QgReI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30569 2026-06-01 cs.RO 83%

Any-ttach: Quick End-effector Swapping Enables Manipulation Dexterity with Simplicity

Any-ttach: 快速末端执行器更换实现简洁的灵巧操作

Weizhe Ni, Jinzhou Li, Haoyu Li, Cody Andres Alessio-Bunnell, Wenjing Pan, Xianyi Cheng

机构 * Department of Mechanical Engineering and Materials Science, Duke University(杜克大学机械工程与材料科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Any-ttach框架,通过低成本快速末端执行器更换机制,结合任务规划,实现多种工具和末端模块的灵巧操作,在长时任务中验证了可靠性和效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15215 2026-06-01 cs.RO 83%

A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics

用于机器人上下文模仿学习的层次化时空动作分词器

Fawad Javed Fateh, Ali Shah Ali, Murad Popattia, Usman Nizamani, Andrey Konin, M. Zeeshan Zia, Quoc-Huy Tran

机构 * Retrocausal, Inc.(Retrocausal公司)

专题命中 机器人操作 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种层次化时空动作分词器HiST-AT,通过两级向量量化实现动作的层次化聚类,并同时利用空间和时间信息进行重建,在多个模拟和真实机器人操作基准上达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21013 2026-06-01 cs.RO 83%

Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks

笔记到自我:带草稿本的增强型VLA用于依赖记忆的操作任务

Sanjay Haresh, Daniel Dijkman, Apratim Bhattacharyya, Roland Memisevic

机构 * Qualcomm AI Research(高通AI研究)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文通过在视觉-语言-动作模型中加入语言草稿本来赋予其空间和时间记忆,从而提升其在依赖记忆的长时域操作任务上的泛化能力。

Comments To appear at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30282 2026-05-29 cs.RO 83%

Gaze2Act: Gaze-Conditioned Vision-Language-Action Policies for Interactive Robot Manipulation

Gaze2Act: 基于注视条件的视觉-语言-动作策略用于交互式机器人操作

Kuangji Zuo, Gen Li, Bofan Lyu, Yanshuo Lu, Boyu Ma, Shijia Han, Xinyu Zhou, Xichen Yuan, Chuhao Zhou, Jiaqi Bai, Geng Li, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(MARS实验室,南洋理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);分类 cs.RO

AI总结 提出Gaze2Act框架,通过将人类注视作为动态意图信号,结合跨视角语义匹配和策略级条件化,实现机器人对复杂交互任务的精确操作。

Comments Project page: https://zuo-kuangji.github.io/Gaze2Act/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22771 2026-05-29 cs.CL cs.AI 83%

Reducing Political Manipulation with Consistency Training

通过一致性训练减少政治操纵

Long Phan, Devin Kim, Alexander Pan, Alice Blair, Adam Khoja, Dan Hendrycks

机构 * Center for AI Safety(人工智能安全中心) UC Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI

AI总结 针对大语言模型在敏感话题中表现出的隐性政治偏见,提出政治一致性训练(PCT)方法,通过情感一致性和帮助一致性两个指标及相应训练范式来减少偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29378 2026-05-29 cs.RO 83%

Decentralized LLM-Driven Coordination of Acoustic Robots for Contactless Object Manipulation

去中心化LLM驱动的声学机器人协调用于非接触式物体操控

Yingying Wang, Narsimlu Kemsaram, Sriram Subramanian

机构 * Department of Computer Science, University College London(计算机科学系,伦敦大学学院) Department of Artificial Intelligence, University of Malaya(人工智能系,马来大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种去中心化框架,利用Whisper语音识别和LLM语义解析将自然语言指令转换为多机器人任务计划,实现声学机器人的非接触式物体操控,实验验证了顺序、并行和同步协作任务的有效性。

Comments This paper has been accepted for publication in the Proceedings of the 2026 IEEE 22nd International Conference on Automation Science and Engineering (CASE 2026), August 17-21, 2026, Shenyang, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12512 2026-05-29 cs.RO cs.SY eess.SY 83%

Practical Insights on Grasp Strategies for Mobile Manipulation in the Wild

野外移动操作抓取策略的实用见解

Isabella Huang, Richard Cheng, Sangwoon Kim, Dan Kruse, Carolyn Chen, Lukas Kaul, JC Hancock, Shanmuga Harikumar, Mark Tjersland, James Borders, Dan Helmick

机构 * Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文通过SHOPPER移动操作机器人在真实杂货店中的部署实验,提出并分析了通用抓取策略的设计方法及数百次抓取尝试中的关键失败模式,为机器人社区提供了实用见解和待解决的关键挑战。

Comments 8 pages, 8 figures, submitted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28486 2026-05-28 cs.RO 83%

Mag-VLA: Vision-Language-Action Model for Bimanual Magnetically Actuated Microrobot Manipulation

Mag-VLA:用于双臂磁驱动微机器人操作的视觉-语言-动作模型

Yongchen Wang, Kangyi Lu, Lan Wei, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X, Imperial College London(生物工程系,Imperial-X,帝国理工学院伦敦)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Mag-VLA模型,利用双臂磁驱动微机器人实现灵巧操作,通过视觉-语言-动作框架和动作分块Transformer解码器,在真实机器人实验中达到90%接近成功率和最高80%运输成功率。

Comments Accepted by 2026 MARSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27886 2026-05-28 cs.RO 83%

Tabero: Learning Gentle Manipulation with Closed-Loop Force Feedback from Vision, Touch, and Language

Tabero: 通过视觉、触觉和语言闭环力反馈学习轻柔操作

Qiwei Wu, Rui Zhang, Xin Xiang, Tao Li, Weihua Zhang, Junjie Lai, Renjing Xu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Nvidia, Beijing, China(英伟达(北京,中国))

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对现有视觉-语言-动作模型缺乏触觉反馈导致无法实现轻柔操作的问题,提出Tabero基准和模型套件,通过数据高效管道生成视觉-触觉-语言任务,并采用解耦力-位置命令接口的Tabero-VTLA架构,在保持高任务成功率的同时将轻柔指令下的平均夹持力降低70%以上。

Comments Code:https://github.com/NathanWu7/Tabero

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23651 2026-05-26 cs.RO 83%

HeLoM: Hierarchical Learning for Whole-Body Loco-Manipulation by a Hexapod Robot

HeLoM: 六足机器人全身移动操作的分层学习

Xinrong Yang, Peizhuo Li, Hongyi Li, Yifeng Peng, Arhaan Jain, Junkai Lu, Linnan Chang, Yuhong Cao, Yifeng Zhang, Ge Sun, Guillaume Sartoretti

机构 * MARMoT Lab, Department of Mechanical Engineering, National University of Singapore(机械工程系,新加坡国立大学MARMoT实验室) Center for X-mechanics, Zhejiang University(浙江大学X力学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出HeLoM分层框架,通过协调多肢控制实现六足机器人对重/不规则物体的稳定推动,在仿真和实物实验中验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03526 2026-05-26 cs.RO 83%

CollaBot: Vision-Language Guided Simultaneous Collaborative Manipulation

CollaBot: 视觉-语言引导的同步协作操作

Kun Song, Gaoming Chen, Shentao Ma, Ninglong Jin, Guangbao Zhao, Mingyu Ding, Zhenhua Xiong, Jia Pan

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 提出CollaBot通用框架,通过场景分割、协作抓取和两阶段规划,实现多机器人同步协作操作大型物体,在实验中达到72%成功率。

Comments 8 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21330 2026-05-21 cs.RO 83%

Learning Robust Dexterous In-Hand Manipulation from Joint Sensors with Proprioceptive Transformer

从联合传感器学习鲁棒的灵巧手部操作

Senlan Yao, Chenyu Yang, Jaehoon Kim, Aristotelis Sympetheros, Robert K. Katzschmann

机构 * Soft Robotics Laboratory, ETH Zürich, Switzerland(苏黎世联邦理工学院软机器人实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文研究如何仅依靠关节传感进行手部操作,提出了一种无需外部感知的Proprioceptive Transformer方法,通过强化学习训练教师策略并将其转化为PT,实现了在腱驱动灵巧手上的连续立方体旋转,实验表明其在旋转速度和位置估计精度上优于基线方法。

Comments 8 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20894 2026-05-21 cs.RO 83%

Mobile UMI: Cross-View Diffusion Policy with Decoupled Kinematics for Mobile Manipulation

Mobile UMI: 用于移动操作的跨视角扩散策略与解耦动力学

Haoran Huang, Haonan Dong, Huixu Dong

机构 * Zhejiang University(浙江大学)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出了一种无需硬件的演示框架Mobile UMI,通过三个组件解决移动模仿学习中的两个瓶颈问题:运动污染的动作标签和推理导致的执行延迟。核心方法是通过双摄像头捕捉全局和局部上下文,结合空间锚点统一视觉-惯性框架,并利用异步递推地执行器进行在线状态匹配,从而实现解耦的动力学和基座轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20085 2026-05-20 cs.CV 83%

Spatially Prompted Visual Trajectory Prediction for Egocentric Manipulation

基于空间提示的视觉轨迹预测用于目视操控

Yifan Li, Xinyu Zhou, Yunhao Ge, Yu Kong

机构 * Michigan State University(密歇根州立大学) NVIDIA Research(英伟达研究)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.CV

AI总结 本文提出了一种新的视觉轨迹预测方法SP-VTP,通过空间提示定义任务目标,结合任务编码器、观察编码器和轨迹生成器,提升了跨场景的目视操控轨迹预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05156 2026-05-19 cs.RO cs.SY eess.SY 83%

PLATO Hand: Shaping Contact Behavior with Fingernails for Precise Manipulation

PLATO Hand:利用指甲形状接触行为实现精确操控

Dong Ho Kang, Aaron Kim, Mingyo Seo, Kazuto Yokoyama, Tetsuya Narita, Luis Sentis

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Sony Group Corporation(索尼集团)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出PLATO手,一种具有混合指尖的灵活机器人手,通过结合刚性指甲、嵌入式远节指骨和顺应性肉垫,实现接触行为的塑造。研究开发了基于应变能的弯曲-压入模型,指导指尖设计并解释材料刚度和接触几何如何控制指尖变形分配。实验显示提升了捏合稳定性、指甲介导的背侧接触力传输和本体感觉可观察性,并成功执行了敏感边缘操控任务,如纸张分隔、卡片拾取和橙子剥皮。这些结果表明,结合机械结构的接触界面与力-运动透明手指机制提供了精确操控的原理性方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13925 2026-05-18 cs.RO 83%

Towards Robotic Dexterous Hand Intelligence: A Survey

迈向机器人灵巧手智能:一篇综述

Weiguang Zhao, Tian Liang, Xihao Guo, Rui Zhang, Irwin King, Kaizhu Huang

机构 * University of Liverpool(利物浦大学) Xi’an Jiaotong-Liverpool University(西安交通大学-利物浦大学) Duke Kunshan University(杜克-昆山大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 本文综述了灵巧手研究,从硬件、控制方法、数据集和评估等方面分析,探讨了当前研究的局限性和未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03243 2026-05-18 cs.RO 83%

HoMMI: Learning Whole-Body Mobile Manipulation from Human Demonstrations

HoMMI:从人类示范中学习全身移动操作

Xiaomeng Xu, Jisang Park, Han Zhang, Eric Cousineau, Aditya Bhat, Jose Barreiros, Dian Wang, Jeannette Bohg, Shuran Song

机构 * Stanford University(斯坦福大学) Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出HoMMI框架,通过人类示范直接学习全身移动操作,结合眼动感知增强数据收集能力,解决人机体感知差距问题,实现长周期移动操作任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18127 2026-05-18 cs.CV 83%

SFHand: Learning Embodied Manipulation by Streaming Egocentric 3D Hand Forecasting

SFHand: 通过流式注视三维手预测学习具身体验

Ruicong Liu, Yifei Huang, Liangyang Ouyang, Caixin Kang, Yoichi Sato

机构 * The University of Tokyo(东京大学)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.CV

AI总结 SFHand通过流式注视三维手预测实现具身体验,结合流式自回归架构和增强记忆层,首次在语言引导下实现三维手预测,提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02342 2026-05-18 cs.RO 83%

Whole-body motion planning and safety-critical control for aerial manipulation

全身运动规划与安全关键控制用于空中操作

Lin Yang, Jinwoo Lee, Domenico Campolo, H. Jin Kim, Jeonghyun Byun

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机械与航空航天工程学院,南洋理工大学,新加坡) Department of Aerospace Engineering, Seoul National University, South Korea(航空航天工程系,首尔国立大学,韩国)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出基于超级二次曲面的空中操作器全身运动规划与安全关键控制框架,通过融合Voronoi图与平衡流形生成平滑轨迹,并设计高阶控制屏障函数实现碰撞避让,实验验证其在复杂环境中的高效性和鲁棒性。

Comments Will be presented in 23rd IFAC World Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13428 2026-05-14 cs.RO 83%

SID: Sliding into Distribution for Robust Few-Demonstration Manipulation

SID:滑入分布以实现鲁棒的少样本操控

Yicheng Ma, Wei Yu, Zhian Su, Xidan Zhang, Huixu Dong

机构 * Grasp Lab, Zhejiang University(浙江大学抓取实验室) Torch Kernel Co., Ltd.(火炬内核有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 SID通过学习对象中心运动场,使系统在少样本下鲁棒地滑向演示 manifold 和轻量执行策略的可靠区域,提升动态扰动下的操控性能。

Comments 20 pages, 14 figures. Project website: https://sliding-into-distribution.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15953 2026-05-14 cs.RO 83%

ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation

ViTacFormer:学习跨模态表示以实现视觉-触觉灵巧操作

Liang Heng, Haoran Geng, Kaifeng Zhang, Pieter Abbeel, Jitendra Malik

机构 * University of California, Berkeley(加州大学伯克利分校) Peking University(北京大学) Sharpa

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出ViTacFormer,通过跨注意力编码器融合高分辨率视觉与触觉,并结合自回归触觉预测头提升精度与鲁棒性,实现多指手的模仿学习,成功完成高精度灵巧操作任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12228 2026-05-13 cs.RO 83%

Morphologically Equivariant Flow Matching for Bimanual Mobile Manipulation

形态等变流匹配用于双臂移动操作

Max Siebenborn, Daniel Ordoñez Apraez, Sophie Lueth, Giulio Turrisi, Massimiliano Pontil, Claudio Semini, Georgia Chalvatzaki

机构 * PEARL Lab, Dept. of Computer Science, TU Darmstadt, Germany(德累斯顿技术大学计算机科学系PEARL实验室) Istituto Italiano di Tecnologia(意大利技术研究院) Robotics Institute Germany(德国机器人研究所)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出利用形态对称性作为诱导偏倚,通过流匹配政策提升双臂移动操作的样本效率和零样本泛化能力。

Comments Preprint. 4 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11144 2026-05-13 cs.RO 83%

Forecast-aware Gaussian Splatting for Predictive 3D Representation in Language-Guided Pick-and-Place Manipulation

面向预测的高斯点散布用于语言引导的抓取与放置操作中的预测3D表示

Kaixin Jia, Jiacheng Xu

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出Forecast-GS框架,通过预测3D状态提升语言引导的机器人操作性能,实验显示其在抓取与放置任务中优于基线方法,表明明确预测任务完成状态有助于更可靠的行动评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08799 2026-05-12 cs.RO 83%

ElasticFlow: One-Step Physics-Consistent Policy with Elastic Time Horizons for Language-Guided Manipulation

ElasticFlow: 语言引导操作中的弹性时间 horizon 的一步物理一致策略

Kewei Chen, Yayu Long, Shuai Li, Mingsheng Shang

机构 * Chongqing Institute of Green and Intelligent Technology, Chinese Academy of Sciences(中国科学院重庆绿色智能技术研究所) Chongqing School, University of Chinese Academy of Sciences(中国科学院大学重庆校区) Faculty of Information Technology and Electrical Engineering, University of Oulu, Finland(芬兰奥卢大学信息科技与电气工程学院)

专题命中 机器人操作 :manipulation(title);embodied AI(abstract);robotic(abstract);分类 cs.RO

AI总结 ElasticFlow通过弹性时间 horizon 机制和直接建模平均速度场,实现高效的一步映射,提升语言引导操作的物理一致性和效率。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏