arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 61320 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22125 篇

2606.10363 2026-06-10 cs.RO 新提交 88%

HiMem-WAM: Hierarchical Memory-Gated World Action Models for Robotic Manipulation

HiMem-WAM: 用于机器人操作的分层记忆门控世界动作模型

Xiaoquan Sun, Ruijian Zhang, Chen Cao, Yihan Sun, Jiahui Chen, Zetian Xu, Bo Chen, Haijier Chen, Zhen Yang, Jiarun Zhu, Yijun Hong, JingZhe Xu, Jingrui Pang, Mingqi Yuan, Jiayu Chen

机构 * The University of Hong Kong(香港大学) INFIFORCE Huazhong University of Science and Technology(华中科技大学) Tsinghua University(清华大学) Wuhan University(武汉大学) Southern University of Science and Technology(南方科技大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 提出分层记忆门控世界动作模型HiMem-WAM,通过分层潜在动作框架和边界触发记忆更新,提升长时域机器人操作的任务相关记忆与泛化鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06049 2026-06-05 cs.RO 88%

L-SDPPO: Policy Optimization of Spiking Diffusion Policy for Intra-vehicular Robotic Manipulation

L-SDPPO:用于舱内机器人操作的脉冲扩散策略优化

Liwen Zhang, Dong Zhou, Guanghui Sun, Yifei Zheng, Yuhui Hu, Kaihong Ouyang, Zuoquan Zhao

机构 * Department of Control Science and Engineering, Harbin Institute of Technology(控制科学与工程系,哈尔滨工业大学) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(机械与自动化工程系,香港中文大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 提出L-SDPPO框架,结合脉冲扩散策略与强化学习优化,并引入状态依赖延迟注入机制,在舱内机器人操作任务中实现高成功率和低能耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01047 2026-06-02 cs.RO 88%

Learning Multi-Modal Trajectory Policies for Data-Efficient Robotic Manipulation

学习多模态轨迹策略以实现数据高效的机器人操作

Zijia Chen, Yuenan Hou, Xinhua Jiang, Yu Li, Weijie Li, Li Liu

机构 * College of Electronic Science and Technology, National University of Defense Technology(电子科学学院,国防科技大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 针对机器人操作中数据稀缺导致的多模态干扰问题,提出基于混合专家模型的多模态轨迹预测框架MATE,通过细粒度子令牌特征解耦和跨模态余弦路由器实现稳定专家分配,在LIBERO基准和真实乒乓球实验中取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26638 2026-05-27 cs.RO 88%

HyperSim: A Holistic Sim-To-Real Framework For Robust Robotic Manipulation

HyperSim: 一种面向鲁棒机器人操作的整体仿真到现实框架

Junyi Dong, Haotian Luo, Ziwei Xu, Shengwei Bian, Heng Zhang, Sitong Mao, Jingyi Guo, Yang Xu, Wenhao Chen, Qiuyu Feng, Yao Mu, Ping Luo, Shunbo Zhou, Xiaodong Wu

机构 * CloudRobo Lab, Huawei Cloud Computing Technologies Co.,Ltd.(华为云计算技术有限公司云机器人实验室) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出HyperSim框架,通过高保真环境合成、对抗轨迹生成和仿真-现实联合训练三大支柱,系统性地缩小仿真到现实的域差距,在400次真实世界任务执行中实现了ACT和π0分别达到80%和95%的仿真到现实成功率。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17057 2026-05-26 cs.RO 88%

RoboManipBaselines: A Unified Framework for Imitation Learning in Robotic Manipulation across Real and Simulation Environments

RoboManipBaselines:面向真实与仿真环境的机器人操作模仿学习统一框架

Masaki Murooka, Tomohiro Motoda, Ryoichi Nakajo, Hanbit Oh, Koshi Makihara, Keisuke Shirai, Tetsuya Ogata, Yukiyasu Domae

机构 * Artificial Intelligence Research Center, National Institute of Advanced Industrial Science and Technology (AIST)(日本国家先进工业科学技术研究院人工智能研究中心) CNRS-AIST JRL (Joint Robotics Laboratory), IRL(法国国家科学研究中心与日本AIST联合机器人实验室) Institute for AI and Robotics, Future Robotics Organization, Waseda University(早稻田大学未来机器人组织人工智能与机器人研究所) AI Robot Association (AIRoA)(人工智能机器人协会)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 提出RoboManipBaselines开源框架,统一支持仿真和真实环境下的机器人操作模仿学习全流程,包括数据收集、策略训练和部署,并通过基准测试和研究应用验证其有效性。

Comments Added a Limitations section in response to comments from reviewers

Journal ref IEEE Access 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21811 2026-05-22 cs.RO 88%

Safe and Steerable Geometric Motion Policies for Robotic Dexterous Manipulation

安全且可操控的几何运动策略用于机器人灵巧操作

Albert Wu, Riccardo Bonalli, Thomas Lew, C. Karen Liu

机构 * Computer Science Department, Stanford University(斯坦福大学计算机科学系) Laboratory of Signals and Systems, University of Paris-Saclay, CNRS, CentraleSupélec(巴黎-萨克雷大学信号实验室,CNRS,CentraleSupélec) Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本研究提出SafePBDS框架,通过几何一致的方法计算最优且可证明安全的配置流形加速度,以实现机器人灵巧操作中的目标和约束的持续协调,并在模拟和Franka Panda-Allegro手平台上验证了其在灵巧抓取和手部重定向中的高效规划和安全保障。

Comments 24 pages, 10 figures, 5 tables. Project page and demo video: https://tml.stanford.edu/safe-pbds

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24681 2026-05-22 cs.RO 88%

Learning Human-Intention Priors from Large-Scale Human Demonstrations for Robotic Manipulation

从大规模人类示范中学习人类意图先验以用于机器人操作

Yifan Xie, YuAn Wang, Guangyu Chen, Jinkun Liu, Yu Sun, Wenbo Ding

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robot learning(abstract);分类 cs.RO

AI总结 本文提出MoT-HRA框架,通过大规模人类示范学习人类意图先验,用于机器人操作,通过构建HA-2.2M数据集和三个耦合专家提升动作合理性和鲁棒性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15548 2026-05-18 cs.RO 88%

KaRMA: A Kinematic Metric for Fine Manipulation Ability in Robotic Hands

KaRMA:一种用于机器人手精细操作能力的运动学指标

Martin Peticco, Pulkit Agrawal

机构 * Improbable AI Lab, Massachusetts Institute of Technology(Improbable AI实验室,麻省理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 KaRMA是一种基于运动学的指标,用于衡量机器人手在保持接触的情况下连续改变物体姿态的能力,通过球形测试物体的可达平移和重新定向来评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11951 2026-05-13 cs.RO 88%

From Reaction to Anticipation: Proactive Failure Recovery through Agentic Task Graph for Robotic Manipulation

从反应到预见:通过代理任务图实现机器人操作的前瞻性故障恢复

Sheng Xu, Ruixing Jin, Huayi Zhou, Bo Yue, Guanren Qiao, Yunxin Tai, Yueci Deng, Kui Jia, Guiliang Liu

机构 * Sheng Xu Ruixing Jin Huayi Zhou Bo Yue Guanren Qiao Yunxin Tai Kui Jia Guiliang Liu

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出AgentChord系统,通过代理任务图实现前瞻性故障恢复,提升机器人操作的可靠性和自主性。

Comments 18 pages, accepted to RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01008 2026-05-12 cs.RO 88%

DexWrist: A Robotic Wrist for Constrained and Dynamic Manipulation

DexWrist:一种用于受限和动态操作的机械腕

Martin Peticco, Gabriella Ulloa, John Marangola, Nitish Dashora, Pulkit Agrawal

机构 * Improbable AI Lab, Massachusetts Institute of Technology(Improbable AI实验室,麻省理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 DexWrist通过结合准直接驱动和解耦并行运动机制,在紧凑设计中实现高扭矩和动态接触任务,提升了受限环境中的操作性能。

Comments 9 pages, 8 figures. Submitted to RA-L 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00159 2026-05-04 cs.RO 88%

E$^2$DT: Efficient and Effective Decision Transformer with Experience-Aware Sampling for Robotic Manipulation

E$^2$DT:高效且有效的决策Transformer与经验感知采样用于机器人操作

Kaiyan Zhao, Borong Zhang, Yiming Wang, Xingyu Liu, Xuetao Li, Yuyang Chen, Xiaoguang Niu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) State Key Lab of Internet of Things for Smart City and Department of Computer Information Science, University of Macau(澳门大学物联网智能城市重点实验室和计算机信息科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出E$^2$DT,一种基于决策Transformer的k-确定性点过程采样框架,通过主动塑造经验选择提升机器人操作任务的效率和效果。

Comments ICRA2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21723 2026-05-04 cs.RO 88%

VLBiMan: Vision-Language Anchored One-Shot Demonstration Enables Generalizable Bimanual Robotic Manipulation

VLBiMan: 视觉-语言锚定的一次示例演示使通用化双臂机器人操作成为可能

Huayi Zhou, Kui Jia

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 VLBiMan通过任务感知分解从单个示例中提取可重用技能,实现双臂机器人操作的通用化,减少演示需求并增强跨平台适应性。

Comments accepted by ICLR 2026. The project link is https://hnuzhy.github.io/projects/VLBiMan/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22615 2026-05-01 cs.RO 88%

GazeVLA: Learning Human Intention for Robotic Manipulation

GazeVLA:学习人类意图以促进机器人操作

Chengyang Li, Kaiyi Xiong, Yuan Xu, Lei Qian, Yizhou Wang, Wentao Zhu

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology, Ningbo(宁波东部科技研究院) Peking University(北京大学) ShanghaiTech University(上海科技大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出GazeVLA框架,通过学习人类意图弥合人机之间的固有差距,提升机器人操作性能。

Comments Project page: https://gazevla.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17876 2026-04-21 cs.RO 88%

OFlow: Injecting Object-Aware Temporal Flow Matching for Robust Robotic Manipulation

OFlow:注入对象感知的时间流匹配以实现稳健的机器人操作

Kuanning Wang, Ke Fan, Chenhao Qiu, Zeyu Shangguan, Yuqian Fu, Yanwei Fu, Daniel Seita, Xiangyang Xue

机构 * Fudan University(复旦大学) University of Southern California(南加州大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 OFlow通过统一时间预测和对象感知推理,提升机器人操作的鲁棒性,实验表明对象感知预测增强了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15938 2026-04-20 cs.RO 88%

VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation

VADF:面向高效机器人操作的视觉自适应扩散策略框架

Xinglei Yu, Zhenyang Liu, Shufeng Nan, Simo Wu, Yanwei Fu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出VADF框架,通过视觉驱动的双适应方法减少训练收敛步骤并提升推理早期成功率,采用通用设计可无缝集成至任何扩散策略架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17441 2026-04-14 cs.RO 88%

RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation

RoboCOIN:一个开源的双臂机器人数据集用于集成操作

Shihan Wu, Xuecheng Liu, Shaoxuan Xie, Pengwei Wang, Xinghang Li, Bowen Yang, Zhe Li, Kai Zhu, Hongyu Wu, Yiheng Liu, Zhaoye Long, Runtian Xu, Yue Wang, Chong Liu, Dihan Wang, Ziqiang Ni, Xiang Yang, You Liu, Ruoxuan Feng, Lei Zhang, Denghang Huang, Chenghao Jin, Anlan Yin, Xinlong Wang, Zhenguo Sun, Junkai Zhao, Mengfei Du, Mingyu Cao, Xiansheng Chen, Hongyang Cheng, Xiaojie Zhang, Yankai Fu, Ning Chen, Cheng Chi, Sixiang Chen, Huaihai Lyu, Xiaoshuai Hao, Yequan Wang, Bo Lei, Dong Liu, Xi Yang, Yance Jiao, Tengfei Pan, Yunyan Zhang, Songjing Wang, Ziqian Zhang, Xu Liu, Ji Zhang, Caowei Meng, Zhizheng Zhang, Jiyang Gao, Song Wang, Xiaokun Leng, Zhiqiang Xie, Zhenzhen Zhou, Peng Huang, Wu Yang, Yandong Guo, Yichao Zhu, Suibing Zheng, Hao Cheng, Xinmin Ding, Yang Yue, Huanqian Wang, Chi Chen, Jingrui Pang, YuXi Qian, Haoran Geng, Lianli Gao, Haiyuan Li, Bin Fang, Gao Huang, Yaodong Yang, Hao Dong, He Wang, Hang Zhao, Yadong Mu, Di Hu, Hao Zhao, Tiejun Huang, Shanghang Zhang, Yonghua Lin, Zhongyuan Wang, Guocai Yao

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出RoboCOIN数据集,包含18万多个演示,涵盖15种机器人平台,通过分层能力金字塔提供精细标注,提升双臂操作模型性能。

Comments Add experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27537 2026-03-31 cs.RO 88%

Learning Smooth and Robust Space Robotic Manipulation of Dynamic Target via Inter-frame Correlation

通过帧间相关性学习动态目标的平滑和鲁棒空间机械臂操作

Siyi Lang, Hongyi Gao, Yingxin Zhang, Zihao Liu, Hanlin Dong, Zhaoke Ning, Zhiqiang Ma, Panfeng Huang

机构 * Research Center for Intelligent Robotics, School of Astronautics, Northwestern Polytechnical University(西北工业大学航天学院智能机器人研究中心) School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院) School of Aeronautics and Astronautics, Sichuan University(四川大学空天科学与工程学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种数据驱动的空间机械臂操作方法,通过利用历史帧与当前帧的时序相关性,实现对未知和非结构化空间环境中动态目标的精确操控。

Comments none

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13315 2026-03-27 cs.RO 88%

Bi-HIL: Bilateral Control-Based Multimodal Hierarchical Imitation Learning via Subtask-Level Progress Rate and Keyframe Memory for Long-Horizon Contact-Rich Robotic Manipulation

双侧控制基于多模态分层模仿学习的长时程接触丰富机械臂操作

Thanpimon Buamanee, Masato Kobayashi, Yuki Uranishi

机构 * The University of Osaka(大阪大学) Kobe University(神户大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出Bi-HIL框架,通过子任务级进度率和关键帧记忆实现长时程接触丰富机械臂操作的稳定分层协调,验证了显式建模子任务进展与力感知控制的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21051 2026-03-24 cs.RO 88%

Cortical Policy: A Dual-Stream View Transformer for Robotic Manipulation

皮层策略:一种双流视图变换器用于机器人操作

Xuening Zhang, Qi Lv, Xiang Deng, Miao Zhang, Xingbo Liu, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shandong Jianzhu University(山东建筑大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出Cortical Policy,通过双流视图变换器提升机器人操作中的空间和动态推理能力,实验证明其在复杂任务中的优越性。

Comments Published as a conference paper at ICLR 2026. 10 pages, 4 figures. Appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11052 2026-03-20 cs.RO 88%

AdaptPNP: Integrating Prehensile and Non-Prehensile Skills for Adaptive Robotic Manipulation

AdaptPNP: 集成抓取与非抓取技能以实现适应性机器人操控

Jinxuan Zhu, Chenrui Tie, Xinyi Cao, Yuran Wang, Jingxiang Guo, Zixuan Chen, Haonan Chen, Junting Chen, Yangyu Xiao, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) RoboScience(机器人科学) East China Normal University(华东师范大学) Peking University(北京大学) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出AdaptPNP框架,通过视觉-语言模型整合抓取与非抓取技能,实现复杂机器人操控任务的规划与执行。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15134 2026-03-17 cs.RO 88%

Confusion-Aware In-Context-Learning for Vision-Language Models in Robotic Manipulation

面向机器人操作的上下文学习:考虑混淆的视觉语言模型

Yayun He, Zuheng Kang, Botao Zhao, Zhouyin Wu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Shenzhen Bao'an Middle School(深圳宝安中学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出CAICL方法,通过混淆定位与分析提升视觉语言模型在机器人操作中处理混淆场景的能力,实验显示其在VIMA-Bench上成功率达85.5%。

Comments Accepted by the 29th International Conference on Computer Supported Cooperative Work in Design (CSCWD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13825 2026-03-17 cs.RO 88%

Building Explicit World Model for Zero-Shot Open-World Object Manipulation

构建显式世界模型以实现零样本开放世界物体操控

Xiaotong Li, Gang Chen, Javier Alonso-Mora

专题命中 机器人操作 :manipulation(title,abstract);world model(title);robotics(abstract);分类 cs.RO

AI总结 本文提出基于显式世界模型的框架,通过构建物理基础的数字孪生实现零样本泛化,无需任务特定示范即可完成开放集操控任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12967 2026-03-16 cs.RO 88%

Language-Grounded Decoupled Action Representation for Robotic Manipulation

基于语言的解耦动作表示用于机器人操作

Wuding Weng, Tongshu Wu, Liucheng Chen, Siyu Xie, Zheng Wang, Xing Xu, Jingkuan Song, Heng Tao Shen

机构 * School of Computer Science and Technology, Tongji University, China(同济大学计算机科学与技术学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出LaDA框架,通过自然语言连接感知与控制,引入可解释的动作原始语义,提升动作生成的鲁棒性和泛化能力。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12730 2026-03-16 cs.RO 88%

AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation

AnchorVLA4D: 一种基于锚点的时空视觉-语言-动作模型用于机器人操作

Juan Zhu, Zhanying Shao, Xiaoqi Li, Ethan Morgan, Jiadong Xu, Hongwei Fan, Hao Dong

机构 * PrimeBot School of Computer Science, Peking University(北京大学计算机学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出AnchorVLA4D,通过引入锚点图像和轻量级空间编码器,提升机器人操作中的时空推理能力,实现在Simpler WidowX基准测试中提升13.6%,并在真实任务中达到80%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04848 2026-03-13 cs.RO 88%

Hyperbolic Multiview Pretraining for Robotic Manipulation

双曲多视角预训练用于机器人操作

Jin Yang, Ping Wei, Yixin Chen, Nanning Zheng

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出HyperMVP,一种基于双曲空间的多视角自监督预训练框架,通过GeoLink编码器学习结构化嵌入,提升机器人操作任务的性能。

Comments This paper was submitted to CVPR 2026 and was recommended for Findings, but the authors have withdrawn it and are currently adding more content to submit it elsewhere

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10871 2026-03-12 cs.RO 88%

FG-CLTP: Fine-Grained Contrastive Language Tactile Pretraining for Robotic Manipulation

FG-CLTP: 用于机器人操作的细粒度对比语言触觉预训练

Wenxuan Ma, Chaofan Zhang, Yinghao Cai, Guocai Yao, Shaowei Cui, Shuo Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 FG-CLTP通过细粒度对比学习提升机器人触觉感知,实现高精度分类和控制,减少误差并增强跨传感器泛化能力。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10609 2026-03-12 cs.RO 88%

Learning Bimanual Cloth Manipulation with Vision-based Tactile Sensing via Single Robotic Arm

通过单个机械臂实现基于视觉的触觉感知的双臂布料操作学习

Dongmyoung Lee, Wei Chen, Xiaoshuai Chen, Rui Zong, Petar Kormushev

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出Touch G.O.G.,通过单个机械臂实现基于视觉的触觉感知的双臂布料操作,结合新颖抓取器设计、视觉Transformer流程和合成数据生成器,实现高精度布料识别与操作。

Comments 11 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11609 2026-03-11 cs.RO 88%

UniBYD: A Unified Framework for Learning Robotic Manipulation Across Embodiments Beyond Imitation of Human Demonstrations

UniBYD: 一种跨具身体的机器人操作学习统一框架

Tingyu Yuan, Biaoliang Guan, Wen Ye, Ziyan Tian, Yi Yang, Weijie Zhou, Zhaowen Li, Yan Huang, Peng Wang, Chaoyang Zhao, Jinqiao Wang

机构 * CASIA(中国科学院自动化研究所) UCAS(乌尔姆大学) XJTU(西安交通大学) CSU(中国科学技术大学) BJTU(北京理工大学) Yinwang Intelligent Technology Co. Ltd.(云网智能技术有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 UniBYD通过动态强化学习和统一形态表示,实现跨具身机器人操作学习,提升任务成功率44.08%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03798 2026-03-05 cs.RO 88%

Learning Surgical Robotic Manipulation with 3D Spatial Priors

利用3D空间先验学习手术机器人操作

Yu Sheng, Lidian Wang, Xiaomeng Chu, Jiajun Deng, Min Cheng, Yanyong Zhang, Bei Hua, Houqiang Li, Jianmin Ji

机构 * University of Science and Technology of China(中国科学技术大学) Tuodao Medical(图道医疗) Yale University(耶鲁大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出SST,一种端到端的视觉-运动策略,通过内窥镜图像中的3D空间线索提升手术机器人操作的3D空间意识,实现了复杂手术任务的高性能表现。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00500 2026-03-03 cs.RO 88%

Zero-Shot Robotic Manipulation via 3D Gaussian Splatting-Enhanced Multimodal Retrieval-Augmented Generation

通过3D高斯点云增强的多模态检索增强生成实现零样本机器人操作

Zilong Xie, Jingyu Gong, Xin Tan, Zhizhong Zhang, Yuan Xie

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出RobMRAG框架,通过3D高斯点云增强多模态检索增强生成,提升零样本机器人操作的泛化能力和可解释性。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏