arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 987 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 987 篇

2606.21461 2026-06-23 cs.RO 新提交 79%

Manipulider: A Multi-Engine Buoyancy-Controlled Robot for Thrusterless Underwater Gliding and Manipulation

Manipulider: 一种用于无推进器水下滑翔和操作的多引擎浮力控制机器人

Yitao Jiang, Yewei Huang, Weizhi Cao, Mingi Jeong, Alberto Quattrini Li, Luyang Zhao, Muhao Chen, Devin Balkcom

机构 * Dept. of Computer Science, Dartmouth College(达特茅斯学院计算机科学系) Dept. of Mechanical and Aerospace Engineering, University of Houston(休斯顿大学机械与航空航天工程系) Dept. of Aerospace and Ocean Engineering, Virginia Tech(弗吉尼亚理工大学航空航天与海洋工程系) Dept. of Electrical and Computer Engineering, Clemson University(克莱姆森大学电气与计算机工程系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出一种基于浮力驱动的无推进器水下机器人Manipulider,通过四个注射器式浮力引擎调节净浮力和浮心,实现大倾斜角静态平衡和姿态操作,并具备磁模块化接口。实验验证了单引擎64.6°和双引擎61.8°的最大静态倾斜角,以及垂直和倾斜过渡动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21245 2026-06-23 cs.RO 新提交 79%

A Human-Inspired Thumb-Index Robotic Hand with Strain Gauges Embedded in Soft Joints

一种受人类启发的拇指-食指机械手,其软关节中嵌入应变片

Jonas Papenbrock, Shubhan Patni, Tomaso Lisini Baldi, Michele Guerri, Elia Landi, Ada Fort, Matej Hoffmann

机构 * University of Siena(锡耶纳大学) Czech Technical University in Prague(布拉格捷克理工大学)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 受生物力学原理启发,开发了安全拇指-食指机械手(STIR Hand),通过欠驱动腱驱动设计与嵌入硅胶软关节的柔性应变片,实现被动抓取适应,并建立内部本体感知和外部感知。实验表明,软关节传感器显著提高了抓取灵敏度和安全性。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21188 2026-06-23 cs.RO 新提交 79%

Remember what you did?: Learning Behavioral Memories for Partially Observable Object Manipulation

记住你做了什么?:学习部分可观察物体操作的行为记忆

Kuancheng Wang, Seungho Yeom, Jinglin Cao, Yuheng Zhi, Nikhil Shinde, Michael Yip

机构 * UC San Diego(加州大学圣地亚哥分校)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对长时域、接触式操作中的部分可观测问题,提出压缩动作记忆策略(CAMP),通过自监督学习动作历史压缩表示,隐式追踪任务进度并从失败中学习,在多个真实和仿真任务上超越现有方法。

Comments Project website: robo-camp.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21148 2026-06-23 cs.RO 新提交 79%

Pose-Agnostic Robotic Functional Grasping via Observation-Action Canonicalization

通过观测-动作规范化实现姿态无关的机器人功能性抓取

Le Qiu, Cole Harrison, Jiankai Sun, Yao Liu, Suning Huang, Qianzhong Chen, Yang You, Marco Pavone

机构 * Tsinghua University(清华大学) Amazon(亚马逊) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 提出AnyMug框架,通过观测-动作规范化将深度观测和末端执行器动作转换到物体中心坐标系,训练单一闭环策略实现零样本迁移的功能性抓取,在模拟和真实机器人上均取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19340 2026-06-23 cs.RO 新提交 79%

ZeroDex: Zero-Shot Long-Horizon Dexterous Manipulation via Multi-View 3D-Grounded VLM Reasoning

零样本长时程灵巧操作:基于多视图3D接地VLM推理

Jisoo Kim, Sangwon Baik, Taeksoo Kim, Sungjoo Kim, Junyoung Lee, Mingi Choi, Hanbyul Joo

机构 * Seoul National University(首尔国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出零样本框架,利用多视图RGB图像通过VLM生成3D任务规划,结合三角测量和射线投票实现精确3D接地,支持抓取和工具使用,在真实实验中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18239 2026-06-23 cs.RO 新提交 79%

EBench: Elemental Diagnosis of Generalist Mobile Manipulation Policies

EBench: 通用移动操作策略的要素诊断

Ning Gao, Jinliang Zheng, Xing Gao, Haoxiang Ma, Hanqing Wang, Yukai Wang, Jiantong Chen, Zanxin Chen, Shujie Zhang, Mingda Jia, Xuekun Jiang, Zihou Zhu, Xinyu Li, Shuai Wang, Hao Li, Wenzhe Cai, Yuqiang Yang, Xudong Xu, Zhaoyang Lyu, Yao Mu, Tai Wang, Jiangmiao Pang, Jia Zeng, Weinan Zhang, Chunhua Shen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学智能产业研究院) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出EBench基准,从5个能力和4个泛化维度诊断通用移动操作模型,揭示不同模型在成功率相近时能力差异显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16272 2026-06-23 cs.RO 新提交 79%

TopoRetarget: Interaction-Preserving Retargeting for Dexterous Manipulation

TopoRetarget:面向灵巧操作的交互保持重定向

Jielin Wu, Shenzhe Yao, Guanqi He, Xiaohan Liu, Zhaoqing Zeng, Xiangrui Jiang, Han Yang, Wentao Zhang, Hang Zhao

机构 * IIIS, Tsinghua University(清华大学交叉信息研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出TopoRetarget框架,通过稀疏交互图和距离加权拉普拉斯变形,在重定向中保持手-物体交互结构,提升灵巧操作强化学习策略的性能。

Comments Project page: https://toporetarget2026.github.io/TopoRetarget/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17982 2026-06-17 cs.RO 新提交 79%

LAGO Policy: Latency-Aware Asynchronous Diffusion Policies with Goal-Directed Collision-Free Planning for Smooth Manipulation

LAGO策略:面向平滑操作的延迟感知异步扩散策略与目标导向无碰撞规划

Guowei Shi, Xupeng Xie, Yiming Luo, Jian Guo, Jun Ma, Boyu Zhou

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) International Digital Economy Academy(国际数字经济学院) The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出LAGO策略,通过延迟感知条件引导和时空轨迹优化,解决异步扩散策略的间断和碰撞问题,实现平滑安全的操作。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16504 2026-06-16 cs.RO 新提交 79%

APEX: Adaptive Policy Execution for Precise Manipulation

APEX: 用于精确操作的适应性策略执行

Mengfei Zhao, Chenxi Jiang, Tuo An, Jindou Jia, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对策略与控制器间的执行差距,提出即插即用的APEX框架,通过动态可行参考重建和测试时自适应,减少跟踪误差并提升操作成功率。

Comments 20 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16078 2026-06-16 cs.RO 新提交 79%

A Deployment Case Study in Robotic Apparel Automation: Digital Twin Integration, Interoperability, and Workforce Enablement

机器人服装自动化部署案例研究:数字孪生集成、互操作性与劳动力赋能

Gokul Narayanan, Abhiroop Ajith, Jonathan Zornow, Carlos Calle, Auralis Herrero Lugo, Jose Luis Susa Rincon, Chengtao Wen, Eugen Solowjow

机构 * Siemens Corporation(西门子股份公司) Sewbo Levi's(李维斯) Bluewater Defense

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 针对织物柔性导致的机器人操作难题,本文通过牛仔布制造案例,提出集成数字线程、数字孪生、互操作层及运行时监控的机器人缝纫系统,实现快速部署与鲁棒性提升。

Comments 4 pages, 3 figures, IEEE ICRA 2026 Workshop Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15338 2026-06-16 cs.RO 新提交 79%

SimWeaver: Zero-Shot RGB Sim-to-Real for Deformable Manipulation

SimWeaver:面向可变形操作的零样本RGB仿真到现实

Wenkang Hu, Haoran Wang, Yitong Li, Liu Liu, Mengao Zhao, Lai Jiang, Xincheng Tang, Junhang Wei, Zhengjie Shu, Zhendong Wang, Zhizhong Su, Huamin Wang, Ruigang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Horizon Robotics(地平线机器人) Style3D Research(Style3D研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出SimWeaver框架,通过200条仿真演示训练零样本RGB VLA策略,在5种可变形任务中达到91%平均真实成功率,无需遥操作或任务校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14535 2026-06-15 cs.RO 新提交 79%

Spatially Conditioned Diffusion Policy: Learning Precise and Robust Manipulation with a Single RGB Camera

空间条件扩散策略:使用单个RGB相机学习精确且鲁棒的操作

Seoyoon Kim, Kanghyun Kim, Dongwoo Ko, Yeong Jin Heo, Min Jun Kim

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Neuromeka

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出空间条件扩散策略(SCDP),利用末端执行器轨迹作为视觉注意力锚点,通过多尺度特征编码和空间条件模块,在单相机设置下实现精确鲁棒的操作。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13394 2026-06-12 cs.RO 新提交 79%

GeoHAT: Geometry-Adaptive Hybrid Action Transformer for Mobile Manipulation

GeoHAT: 几何自适应混合动作Transformer用于移动操作

Xiangyu Zhu, Renjun Wu, Luzhou Ge, Jinyan Liu, Xuesong Li

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出GeoHAT框架,通过轻量级傅里叶空间编码器注入几何信息,并采用混合全身动作解码器分解机械臂与基座动作,在ManiSkill-HAB基准上成功率提升23.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13352 2026-06-12 cs.RO 新提交 79%

Low cost, easily manufactured, highly flexible strain and touch sensitive fiber for robotics applications

低成本、易制造、高柔性应变与触觉传感纤维用于机器人应用

Christian Diaz Herrera, Srushti Raste, Simin Liu, Miles Modeste, Jiyang, Yin, Katelyn McCall, Yuxing Jared Yao, Roopkamal Chahal, Simon Chidley, Trung Ha, T. David Westmoreland, Sonia Roberts

机构 * Wesleyan University(卫斯理大学)

专题命中 机器人操作 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 提出一种仅用廉价商用部件和工具快速制造的导电纤维,兼具电阻应变传感和电容触觉传感功能,实验验证其在机器人抓取、姿态估计和近场跟踪中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13232 2026-06-12 cs.RO 新提交 79%

WT-UMI: Tactile-based Whole-Body Manipulation via Force-Supervised Contact-Aware Planning

WT-UMI: 基于触觉的全身操控通过力监督的接触感知规划

Jaehwi Jang, Zhaoyuan Gu, Alfred Cueva, Zimeng Chai, Junjie Sheng, Thong Nguyen, Himank Galundia, Yifan Wu, Huishu Xue, Isaac Legene, Ojas Mediratta, Davin Doan, Andrew Collins, Sarah Sadegh, KyoungMok Kim, Rishita Dhalbisoi, Zun Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机械研究所,佐治亚理工学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出WT-UMI系统,结合人体演示与遥操作数据,通过力监督规划器预测末端执行器位姿和接触力轨迹,并利用触觉导纳控制器提升全身操控性能。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12759 2026-06-12 cs.RO 新提交 79%

Sparse2Act: Learning Action-Aligned Sparse 3D Representations for Cross-Domain Robot Manipulation

Sparse2Act: 学习跨域机器人操作的动作对齐稀疏3D表示

Yu Guo, Chang Yu, Siyu Ma, Yunuo Chen, Yin Yang, Ying Nian Wu, Chenfanfu Jiang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of California, San Diego(加州大学圣迭戈分校) University of Utah(犹他大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出Sparse2Act框架,通过动作对齐的掩码稀疏3D编码预训练,实现跨域机器人操作,在LIBERO-10上达86.9%成功率,并支持域迁移和sim-to-real。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12028 2026-06-11 cs.RO 新提交 79%

VICX: Generalizable Robot Manipulation via Video Generation and In-Context Operator Network

VICX: 通过视频生成和上下文操作网络实现可泛化的机器人操作

Song Chen, Linyan Xiang, Ying Zhou, Liu Yang

机构 * National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出VICX框架,利用冻结视频生成模型生成视觉计划,并通过视频到轨迹的上下文操作网络(V2T-ICON)将其映射为机器人可执行轨迹,实现跨任务、跨本体泛化。

Comments The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10808 2026-06-10 cs.RO 新提交 79%

Bridging Semantics and Physical Execution: A Neuro-Symbolic Framework for Multi-Pair Robotic Assembly

桥接语义与物理执行:面向多对机器人装配的神经符号框架

Xinyi Li, Aiguo Song, Linhu Wei, Huijun Li

机构 * School of Instrument Science and Engineering, Southeast University(东南大学仪器科学与工程学院)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 提出一种端到端神经符号框架,通过分层生成最优子图、解耦通用性与边缘情况、协调全局序列,解决非结构化环境中多对装配的空间干扰和接触不确定性,在100个真实场景中达到97%全局可执行性,UR3机械臂部署成功率90%。

Comments Corresponding author: Aiguo Song (a.g.song@seu.edu.cn)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10039 2026-06-10 cs.RO 新提交 79%

Robotic Nonprehensile Object Transportation with a Hanging Tray

使用悬挂托盘的机器人非抓取式物体运输

Adam Heins, Angela P. Schoellig

机构 * University of Toronto(多伦多大学) Technical University of Munich(慕尼黑技术大学)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 针对机器人服务员问题,提出使用绳索悬挂托盘实现三维摆运动,仅需3自由度移动基座即可减少滑动和泼洒,实验验证了有效性并集成到交互演示中。

Comments 8 pages, 11 figures. IEEE/ASME International Conference on Advanced Intelligent Mechatronics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08152 2026-06-09 cs.RO 新提交 79%

Vision-Guided Dual-Arm Humanoid Robotic Disassembly of End-of-Life 18650 Lithium-ion Battery Packs

视觉引导的双臂人形机器人拆解报废18650锂离子电池组

Yile Chen, Zhihao Liu, Xi Vincent Wang, Lihui Wang

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 提出一种视觉引导的双臂拆解流水线,利用通用平行爪夹持器、RGB-D感知和预训练抓取检测器,在无夹具条件下从任意初始姿态拆解21节18650电池组,实现80%端到端成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08121 2026-06-09 cs.CV 新提交 79%

Trustworthy Visual Predicates for Robust Manipulation Understanding under Degradation

可信视觉谓词用于退化条件下的鲁棒操作理解

Fatemeh Ziaeetabar

机构 * University of Tehran(德黑兰大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 提出谓词级可靠性框架,通过结构化谓词词汇表、置信度感知估计和可靠性度量,分析模糊、遮挡等退化对操作理解中视觉谓词的影响,实验表明接触敏感和动态谓词更脆弱。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06569 2026-06-08 cs.RO 新提交 79%

PhyRoGen: Synthetic Generation of Physical Robot Manipulation Puzzles Using Procedural Content Generation

PhyRoGen:使用程序化内容生成物理机器人操作谜题的合成生成

Lennart Julian Droß, Andreas Orthey, Marc Toussaint

机构 * Technical University of Berlin(柏林技术大学) Robotics Institute Germany(德国机器人研究所)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出PhyRoGen框架,利用程序化内容生成自动创建机器人操作谜题的合成数据集,生成的24个谜题可在1-300秒内求解,并在物理仿真中验证可操作性。

Comments 8 pages, accepted at CASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11655 2026-08-13 cs.CV cs.AI 新提交 79%

Motion-as-Prompt: Enhancing Motion Reasoning in Multimodal Large Language Models via Motion-Guided Cross-Frame Visual Prompting

运动即提示:通过运动引导的跨帧视觉提示增强多模态大语言模型的运动推理能力

Xikai Sun, Kebin Liu, Haotian Wang, Li Liu, Xu Wang, Yunhao Liu

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文针对多模态大语言模型处理视频时丢失帧间关键运动信息的问题,提出Motion-as-Prompt框架,通过标记轨迹增强视觉提示,在CLEVRER等数据集上提升GPT-5.5的运动推理准确率且不影响非运动理解

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00889 2026-07-02 cs.CV cs.AI 新提交 79%

DeWorldSG: Depth-Aware 3D Semantic Scene Graph Generation via World-Model Priors

DeWorldSG: 基于世界模型先验的深度感知3D语义场景图生成

Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha, Dooyoung Kim, Eunjae Shin, Benjamin Busam, Woontack Woo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) La Trobe University(拉筹伯大学)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 提出DeWorldSG框架,通过深度引导滤波估计实例级3D高斯分布,并利用世界模型先验聚合时空证据,生成时空鲁棒的3D语义场景图,在对象和谓词预测上达到最先进性能。

Comments 19 pages, 6 figures, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23079 2026-06-23 cs.RO cs.AI 新提交 79%

AdaReP:Adaptive Re-Planning under Model Mismatch for Neural World-Model Predictive Control

AdaReP:模型失配下的自适应重规划用于神经世界模型预测控制

Yutian Cheng, Xiaojian Ma, Xianhao Wang, Min Yang, Rongpeng Su, Hangxin Liu, Xi Chen, Shuai Li, Qing Li

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对神经世界模型预测控制中重规划计算开销大的问题,提出AdaReP方法,通过在线自适应调整重规划容忍度,在保持任务性能的同时大幅减少规划器计算量。

Comments Accepted at ICANN 2026. This arXiv version contains supplementary materials and appendices that are omitted from the conference version due to space limitations

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17256 2026-06-17 cs.RO cs.CV 新提交 79%

Contrastive Action-Image Pre-training for Visuomotor Control

对比动作-图像预训练用于视觉运动控制

Yuvan Sharma, Dantong Niu, Anirudh Pai, Zekai Wang, Zhuoyang Liu, Baifeng Shi, Stefano Saravalle, Boning Shao, Ruijie Zheng, Jing Wang, Konstantinos Kallidromitis, Yusuke Kato, Fabio Galasso, Yuke Zhu, Danfei Xu, Linxi "Jim" Fan, Jitendra Malik, Trevor Darrell, Roei Herzig

机构 * UC Berkeley(加州大学伯克利分校) NVIDIA(英伟达) Sapienza University of Rome(罗马大学) Panasonic(松下) ItalAI

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出CAIP方法,利用大规模第一人称视频中3D手部关键点作为代理动作信号,通过对比学习统一动作-图像表示,在少量机器人数据下显著提升灵巧操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14585 2026-06-15 cs.RO cs.AI 新提交 79%

Sensitivity Shaping for Latent Modeling

潜变量建模中的灵敏度塑造

Hongzhan Yu, Chenghao Li, Ruipeng Zhang, Henrik Christensen, Sicun Gao

机构 * University of California San Diego(加利福尼亚大学圣迭戈分校)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对生成动力学模型在策略诱导的分布外(OOD)转换检测中灵敏度不足的问题,提出支持条件控制灵敏度正则化,提升对控制输入变化的局部响应,实验验证了改进的OOD检测和更安全的闭环规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14561 2026-06-15 cs.RO cs.LG 新提交 79%

ORCA: A Platform for Open-Source Dexterity Research

ORCA: 开源灵巧性研究平台

Francesco Capuano, Maximilian Eberlein, Fabrice Bourquin, Clemens Claudio Christoph

机构 * University of Oxford(牛津大学) ETH Zurich(苏黎世联邦理工学院) Orca Dexterity

专题命中 机器人操作 :robotics(abstract);robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 提出ORCA学习栈,统一灵巧手控制、仿真、遥操作和重定向,集成机器人学习框架,实现端到端灵巧操作研究。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13970 2026-06-15 cs.RO cs.LG 新提交 79%

An Attention-based Model for Robust Forecasting with Missing Modality

基于注意力的缺失模态鲁棒预测模型

Zhitian Zhang, Wenjie Zi, Yunduz Rakhmangulova, Saghar Irandoust, Hossein Hajimirsadeghi, Thibaut Durand

机构 * Simon Fraser University(西蒙菲莎大学) RBC Borealis

专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出一种基于条件变分自编码器和Transformer的多模态模型,通过注意力机制学习统一固定维度的表示,在训练和推理中处理缺失模态,在人类轨迹预测和机器人操作预测任务上优于现有方法。

Comments Work originally done in 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09827 2026-06-09 cs.RO cs.CV 新提交 79%

MemoryVLA++: Temporal Modeling via Memory and Imagination in Vision-Language-Action Models

MemoryVLA++:通过记忆与想象在视觉-语言-动作模型中进行时间建模

Hao Shi, Weiye Li, Bin Xie, Yulin Wang, Renping Zhou, Tiancai Wang, Xiangyu Zhang, Ping Luo, Gao Huang

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学) Dexmal StepFun

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出MemoryVLA++框架,通过工作记忆、感知-认知记忆库和想象未来状态的世界模型,实现完整时间建模,在模拟和真实机器人任务上显著提升长时域和依赖记忆与想象的任务性能。

Comments The project is available at https://shihao1895.github.io/MemoryVLA-PP-Web

详情

展开后加载摘要…

URL PDF HTML 收藏