arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 61273 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22109 篇

2605.16043 2026-05-18 cs.RO cs.AI 84%

Learning Sim-Grounded Policies for Bimanual Rope Manipulation from Human Teleoperation Data

从人类遥控数据中学习双臂绳子操作的模拟 grounded 策略

Gina Wigginghaus, Tim Missal, Berk Guler, Simon Manschitz, Jan Peters

机构 * Technical University of Darmstadt(德累斯顿技术大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Robotics Institute Germany (RIG)(德国机器人研究所) Centre for Cognitive Science(认知科学研究中心) Honda Research Institute Europe GmbH(本田欧洲研究院)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);分类 cs.RO、cs.AI

AI总结 本文研究了基于视觉的策略在解结任务中泛化能力不足是否源于观察空间而非策略架构或数据规模,通过比较两种基于动作分块与变压器的策略,发现基于物理状态的策略在预测初始抓取和拉拽动作时L1误差降低了30.8%。

Comments Accepted to the Beyond Teleoperation Workshop at ICRA 2026, 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15836 2026-05-18 cs.RO cs.AI 84%

GAP: Geometric Anchor Pre-training for Data-Efficient Visuomotor Learning of Manipulation Tasks

GAP:用于操作任务数据高效视觉运动学习的几何锚预训练

Davide Buoso, Andrea Protopapa, Stefano Di Carlo, Francesca Pistilli, Giuseppe Averta

机构 * Department of Control and Computer Engineering, Polytechnic University of Turin(控制与计算机工程系,都灵理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出GAP,通过预训练空间适配器生成稳定的几何锚点,提升在稀疏数据下的视觉运动策略学习性能,实验显示其在多个任务中优于其他方法。

Comments Project webpage at https://lambdavi.github.io/gap

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11479 2026-05-13 cs.RO cs.AI 84%

Offline Policy Evaluation for Manipulation Policies via Discounted Liveness Formulation

通过折扣存活公式评估操纵策略的离线策略评估

Hao Wang, Joshua Bowden, Colton Crosby, Somil Bansal

机构 * University of Southern California(南加州大学) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于存活Bellman算子的离线策略评估框架,解决稀疏奖励下任务完成问题,通过保守固定点值函数降低截断偏差,实验证明在折叠任务中优于传统基线方法。

Comments Published at RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10201 2026-05-13 cs.RO cs.AI 84%

HeteroGenManip: Generalizable Manipulation For Heterogeneous Object Interactions

HeteroGenManip:异构物体交互的通用操作

Zhenhao Shen, Zeming Yang, Yue Chen, Yuran Wang, Shengqiang Xu, Mingleyang Li, Hao Dong, Ruihai Wu

机构 * Peking University(北京大学) Tianjin University(天津大学)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出HeteroGenManip框架,通过两阶段方法解决机器人异构物体交互中的接触点定位和轨迹规划问题,实现跨类型物体的鲁棒泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05714 2026-05-08 cs.CV cs.RO 84%

TriRelVLA: Triadic Relational Structure for Generalizable Embodied Manipulation

TriRelVLA:三元关系结构用于可迁移的具身操作

Hanyu Zhou, Chuanhao Ma, Gim Hee Lee

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 TriRelVLA通过构建三元关系结构,解决视觉语言动作模型在未见场景和物体上的泛化问题,提升具身操作的迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00438 2026-05-04 cs.AI cs.RO 84%

Thinking in Text and Images: Interleaved Vision--Language Reasoning Traces for Long-Horizon Robot Manipulation

文本与图像思考:用于长周期机器人操作的交错视觉-语言推理轨迹

Jinkun Liu, Haohan Chi, Lingfeng Zhang, Yifan Xie, YuAn Wang, Long Chen, Hangjun Ye, Xiaoshuai Hao, Wenbo Ding

机构 * Tsinghua University(清华大学) Beijing Institute of Technology(北京理工大学) Xiaomi Group(小米集团)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出IVLR框架,通过显式轨迹表示交替文本子目标与视觉关键帧,提升长周期机器人操作的逻辑与几何一致性,实验显示在LIBERO和SimplerEnv-WidowX上取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08547 2026-04-30 cs.RO cs.CV 84%

R2RGEN: Real-to-Real 3D Data Generation for Spatially Generalized Manipulation

R2RGEN:用于空间通用操作的实现实体3D数据生成

Xiuwei Xu, Angyuan Ma, Hankun Li, Bingyao Yu, Zheng Zhu, Jie Zhou, Jiwen Lu

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Beijing Key Laboratory of Embodied Intelligence Systems(北京智能体智能系统重点实验室) Institute for Embodied Intelligence and Robotics, Tsinghua University(清华大学智能体与机器人研究院) GigaAI

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出R2RGen框架,通过实现实体3D数据生成提升空间通用操作的鲁棒性,采用统一三阶段方法增强数据效率,适用于移动操作场景。

Comments Accepted to RSS 2026. Project page: https://r2rgen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21053 2026-04-24 cs.RO cs.CV 84%

Neuro-Symbolic Manipulation Understanding with Enriched Semantic Event Chains

具有丰富语义事件链的神经符号操控理解

Fatemeh Ziaeetabar

机构 * Department of Computer Science, School of Mathematics, Statistics and Computer Science, College of Science, University of Tehran(德黑兰大学数学、统计学与计算机科学学院计算机科学系) Computer Science, College of Science, University of Tehran(德黑兰大学科学学院计算机科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出eSEC-LAM框架,通过将eSEC转化为显式事件级符号状态,提升操控理解的不确定性处理能力,在动作识别、下一步操作预测和感知噪声鲁棒性方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22364 2026-04-15 cs.RO cs.AI 84%

BINDER: Instantly Adaptive Mobile Manipulation with Open-Vocabulary Commands

BINDER: 基于开放词汇命令的即时自适应移动操作

Seongwon Cho, Daechul Ahn, Donghyun Shin, Hyeonbeom Choi, San Kim, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) ECE, ASRI and IPAI in SNU(SNU的电子工程系、先进机器人研究所和智能感知与人工智能实验室)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO、cs.AI

AI总结 BINDER通过分离战略规划与连续环境监控,结合多模态大语言模型和视频大语言模型,实现动态环境下的高效移动操作,提升鲁棒性和适应性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16811 2026-04-08 cs.CV cs.RO 84%

GeoPredict: Leveraging Predictive Kinematics and 3D Gaussian Geometry for Precise VLA Manipulation

GeoPredict: 借助预测运动学和3D高斯几何实现精确VLA操作

Jingjing Qian, Boyao Han, Chen Shi, Lei Xiao, Long Yang, Shaoshuai Shi, Li Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Hunan University(湖南大学) Voyager Research, Didi Chuxing(滴滴出行沃歌研究)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 GeoPredict通过引入轨迹级模块和预测3D高斯几何模块,提升VLA模型在3D空间推理中的精度,实验表明其在几何密集和空间要求高的任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26660 2026-03-31 cs.RO cs.AI 84%

Ruka-v2: Tendon Driven Open-Source Dexterous Hand with Wrist and Abduction for Robot Learning

Ruka-v2:具备腕关节和关节活动能力的 tendon 驱动开放式灵巧手

Xinqi Lucas Liu, Ruoxi Hu, Alejandro Ojeda Olarte, Zhuoran Chen, Kenny Ma, Charles Cheng Ji, Lerrel Pinto, Raunaq Bhirangi, Irmak Guzey

专题命中 机器人操作 :robot learning(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 Ruka-v2 是一种开放式源代码的 tendon 驱动人形手,具备腕关节和手指的关节活动能力,通过用户研究验证其在机器人学习中的有效性,包括双臂和单臂遥控任务及自主策略学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00939 2026-03-27 cs.RO cs.AI 84%

Constant-Time Motion Planning with Manipulation Behaviors

具有操纵行为的常时间运动规划

Nayesha Gandotra, Itamar Mishani, Maxim Likhachev

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出B-CTMP算法,通过预计算紧凑数据结构,在固定时间内完成两步操纵任务,确保在半结构化环境中实现安全高效的操纵。

Comments In submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10028 2026-03-27 cs.CV cs.RO 84%

3D Dynamics-Aware Manipulation: Endowing Manipulation Policies with 3D Foresight

3D动态感知操控:赋予操控策略三维前瞻性

Yuxin He, Ruihao Zhang, Xianzu Wu, Zhiyuan Zhang, Cheng Ding, Qiang Nie

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) JAKA Robotics Co., Ltd.(JAKA机器人有限公司)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种融合3D世界建模与策略学习的框架,通过引入三个自监督任务提升操控策略的3D前瞻性,实验表明在仿真和现实环境中显著提升操控性能。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24318 2026-03-26 cs.RO cs.AI 84%

Toward Generalist Neural Motion Planners for Robotic Manipulators: Challenges and Opportunities

迈向通用神经运动规划器的机器人机械臂:挑战与机遇

Davood Soleymanzadeh, Ivan Lopez-Sanchez, Hao Su, Yunzhu Li, Xiao Liang, Minghui Zheng

机构 * J. Mike Walker ’66 Department of Mechanical Engineering, Texas A&M University(J. Mike Walker ’66 机械工程系,德克萨斯A&M大学) Lab of Biomechatronics and Intelligent Robotics, Department of Biomedical Engineering, Tandon School of Engineering, New York University(生物机械与智能机器人实验室,生物医学工程系,Tandon工程学院,纽约大学) Department of Computer Science, Columbia University(计算机科学系,哥伦比亚大学) Zachry Department of Civil and Environmental Engineering, Texas A&M University(土木与环境工程系,德克萨斯A&M大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文探讨了通用神经运动规划器在机器人机械臂中的挑战与机遇,分析了现有方法的优缺点,并提出了改进方向。

Journal ref IEEE Transactions on Automation Science and Engineering, vol. 23, pp. 4488-4531, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02393 2026-03-23 cs.RO cs.CV 84%

EgoSpot:Egocentric Multimodal Control for Hands-Free Mobile Manipulation

EgoSpot:面向无手移动操作的视角多模态控制

Ganlin Zhang, Deheng Zhang, Longteng Duan, Guo Han, Yuqian Fu, Danda Pani Paudel, Luc Van Gool, Eric Vollenweider

机构 * Technical University of Munich(慕尼黑技术大学) ETH Zurich(苏黎世联邦理工学院) SJTU(上海交通大学) Microsoft(微软公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种基于微软HoloLens 2混合现实头显的无手控制框架,通过眼动、头部动作和语音指令融合实现机器人移动和机械臂操作的实时控制,提升无障碍交互体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09021 2026-03-18 cs.RO cs.CV 84%

$χ_{0}$: Resource-Aware Robust Manipulation via Taming Distributional Inconsistencies

$χ_{0}$:通过驯服分布不一致性实现资源感知的鲁棒操作

Checheng Yu, Chonghao Sima, Gangcheng Jiang, Hai Zhang, Haoguang Mai, Hongyang Li, Huijie Wang, Jin Chen, Kaiyang Wu, Li Chen, Lirui Zhao, Modi Shi, Ping Luo, Qingwen Bu, Shijia Peng, Tianyu Li, Yibo Yuan

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出$χ_{0}$框架,通过模型算术、阶段优势和训练部署对齐三个技术支柱,解决人示范分布、策略学习偏倚与测试分布之间的分布不一致性问题,实现长周期衣物操作的高可靠性自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15046 2026-03-17 cs.RO cs.AI 84%

AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation

AnoleVLA:基于深度状态空间模型的轻量级视觉-语言-动作模型用于移动操作

Yusuke Takagi, Motonari Kambara, Daichi Yashima, Koki Seno, Kento Tokura, Komei Sugiura

机构 * Keio University(keio大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出AnoleVLA,一种轻量级视觉-语言-动作模型,通过深度状态空间模型高效处理多模态序列,提升移动操作的效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13756 2026-03-17 cs.RO cs.CV 84%

Exploration-assisted Bottleneck Transition Toward Robust and Data-efficient Deformable Object Manipulation

探索辅助的瓶颈过渡:面向鲁棒且数据高效的可变形物体 manipulation

Yujiro Onishi, Ryo Takizawa, Yoshiyuki Ohmura, Yasuo Kuniyoshi

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出ExBot框架,通过引入瓶颈状态和双动作原语解决可变形物体 manipulation 中的out-of-distribution问题,提升数据效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13615 2026-03-17 cs.CV cs.RO 84%

Egocentric World Model for Photorealistic Hand-Object Interaction Synthesis

第一人称世界模型用于逼真手-物体交互合成

Dayou Li, Lulin Liu, Bangya Liu, Shijie Zhou, Jiu Feng, Ziqi Lu, Minghui Zheng, Chenyu You, Zhiwen Fan

机构 * Texas A&M University(德克萨斯A&M大学) University of Minnesota(明尼苏达大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of California, Los Angeles(加州大学洛杉矶分校) University of Texas at Austin(得克萨斯大学奥斯汀分校) Amazon(亚马逊) State University of New York at Stony Brook(纽约州立大学石溪分校)

专题命中 机器人操作 :world model(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文提出EgoHOI模型,通过动作信号模拟物理一致的交互,克服了高速头部运动、严重遮挡和高自由度手部运动带来的挑战,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10373 2026-03-12 cs.RO cs.AI 84%

Few-Shot Adaptation to Non-Stationary Environments via Latent Trend Embedding for Robotics

通过潜在趋势嵌入实现非平稳环境下的少样本适应

Yasuyuki Fujii, Emika Kameda, Hiroki Fukada, Yoshiki Mori, Tadashi Matsuo, Nobutaka Shimada

机构 * College of Information Science and Engineering, Ritsumeikan University(立命馆大学信息科学与工程学院) Production & Technology Department, NIPPN CORPORATION(NIPPN公司生产与技术部门) University of Osaka(大阪大学) National Institute of Technology, Ichinoseki College(国立Ichinoseki学院)

专题命中 机器人操作 :robotics(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于潜在趋势ID的少样本适应框架,通过估计低维环境状态实现非平稳环境下的适应,无需修改模型参数,具有可扩展性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06658 2026-03-12 cs.RO cs.AI 84%

Self-Improving Loops for Visual Robotic Planning

自改进循环用于视觉机器人规划

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 SILVR通过自生成轨迹迭代更新视频模型,实现视觉机器人任务的持续改进,无需人类演示或奖励函数。

Comments ICLR 2026. Project Page: https://diffusion-supervision.github.io/silvr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09121 2026-03-11 cs.RO cs.AI 84%

DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation

DexHiL: 一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架

Yifan Han, Zhongxi Chen, Yuxuan Zhao, Congsheng Xu, Yanming Shao, Yichuan Peng, Yao Mu, Wenzhao Lian

机构 * CASIA(中国科学院自动化研究所) SJTU(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 DexHiL是一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架,通过干预意识的数据采样策略和轻量级远程操作界面,显著提升了模型在不同任务中的成功率。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03960 2026-03-05 cs.RO cs.CV 84%

Structural Action Transformer for 3D Dexterous Manipulation

结构动作变换器用于3D灵巧操作

Xiaohan Lei, Min Wang, Bohong Weng, Wengang Zhou, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出结构动作变换器,通过结构化视角解决高自由度机械手的跨身体技能转移问题,实现更高效的灵巧操作。

Comments Accepted by CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02511 2026-03-04 cs.RO cs.AI 84%

Learning Object-Centric Spatial Reasoning for Sequential Manipulation in Cluttered Environments

在杂乱环境中学习对象导向的空间推理用于序列操作

Chrisantus Eze, Ryan C Julian, Christopher Crick

机构 * Oklahoma State University(俄克拉荷马州立大学) Google DeepMind(谷歌DeepMind)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出Unveiler框架,通过解耦高层空间推理与低层动作执行,提升在密集杂乱环境中检索目标的效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21684 2026-02-26 cs.RO cs.LG 84%

Primary-Fine Decoupling for Action Generation in Robotic Imitation

动作生成中的主-细分离

Xiaohan Lei, Min Wang, Wengang Zhou, Xingyu Lu, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 PF-DAG通过两阶段框架实现动作生成中的主-细分离,提升机器人模仿学习的多模态建模与闭环控制性能。

Comments The Fourteenth International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05662 2026-02-25 cs.RO cs.CV 84%

DeLTa: Demonstration and Language-Guided Novel Transparent Object Manipulation

DeLTa: 人机交互与语言引导的新透明物体操控演示

Taeyeop Lee, Gyuree Kang, Bowen Wen, Youngho Kim, Seunghyeok Back, In So Kweon, David Hyunchul Shim, Kuk-Jin Yoon

机构 * KAIST(韩国科学技术院) NVIDIA(英伟达) KIMM(韩国智能媒体实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 DeLTa通过整合深度估计、6D姿态估计和视觉-语言规划,实现基于自然语言指令的精确长周期透明物体操控,无需额外训练或类别先验。

Comments Project page: https://sites.google.com/view/DeLTa25/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05275 2026-02-24 cs.RO cs.LG 84%

TwinVLA: Data-Efficient Bimanual Manipulation with Twin Single-Arm Vision-Language-Action Models

TwinVLA: 通过双单臂视觉-语言-动作模型实现数据高效的双臂操作

Hokyun Im, Euijin Jeong, Andrey Kolobov, Jianlong Fu, Youngwoon Lee

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Microsoft Research(微软研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 TwinVLA通过模块化组合预训练的单臂视觉-语言-动作模型,实现了高效双臂操作,无需额外双臂数据训练。

Comments Accepted to ICLR 2026 (Poster). Project webpage : https://jellyho.github.io/TwinVLA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17921 2026-02-23 cs.RO cs.LG 84%

Latent Diffeomorphic Co-Design of End-Effectors for Deformable and Fragile Object Manipulation

隐式 diffeomorphic 共设计末端执行器用于可变形和易碎物体 manipulation

Kei Ikemura, Yifei Dong, Florian T. Pokorny

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种隐式 diffeomorphic 共设计框架,联合优化末端执行器形态和控制策略,以提升可变形和易碎物体 manipulation 的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17101 2026-02-20 cs.RO cs.CV 84%

Benchmarking the Effects of Object Pose Estimation and Reconstruction on Robotic Grasping Success

评估物体位姿估计与重建对机器人抓取成功率的影响

Varun Burde, Pavel Burget, Torsten Sattler

机构 * Faculty of Electrical Engineering, Czech Technical University in Prague(捷克技术大学布拉格电子工程系) Czech Institute of Informatics, Robotics and Cybernetics(捷克信息学、机器人学与自动化研究所)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于物理的基准测试,评估三维重建质量对机器人抓取成功率的影响,揭示位姿误差与空间误差对抓取性能的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09013 2026-02-13 cs.RO cs.CV 84%

Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction

通过3D手-物体轨迹重建从RGB人类视频中学习灵巧操作策略

Hongyi Chen, Tony Dong, Tiancheng Wu, Liquan Wang, Yash Jangir, Yaru Niu, Yufei Ye, Homanga Bharadhwaj, Zackory Erickson, Jeffrey Ichnowski

机构 * Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 VIDEOMANIP通过3D手-物体轨迹重建从RGB视频直接学习灵巧操作策略,实现无需设备的高效训练和高成功率抓取

详情

展开后加载摘要…

URL PDF HTML 收藏