arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 61441 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 876 篇

2606.16917 2026-06-23 cs.RO 新提交 76%

Unified Motion-Action Modeling for Heterogeneous Robot Learning

统一运动-动作建模用于异构机器人学习

Yunhao Cao, Shitong Liu, Chao Feng, Meryl Zhang, Xuanchen Lu, Andrew Owens, Kuan Fang

机构 * Cornell University(康奈尔大学)

专题命中 机器人学习 :robot learning(title);分类 cs.RO;manipulation(comments)

AI总结 提出UMA模型,利用3D物体运动轨迹作为共享接口,通过掩码生成目标统一视觉运动控制和动力学建模,实现跨异构数据源的多任务预训练,并在部署时支持多种推理模式。

Comments https://uma-manipulation.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.05421 2018-02-01 cs.RO 76%

DDCO: Discovery of Deep Continuous Options for Robot Learning from Demonstrations

Sanjay Krishnan, Roy Fox, Ion Stoica, Ken Goldberg

专题命中 机器人学习 :robot learning(title,journal_ref);分类 cs.RO

Comments Published at CoRL 2017

Journal ref 1st Conference on Robot Learning (CoRL 2017)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27924 2026-08-18 cs.LG cs.CV cs.RO 版本更新 75%

ODEWorld: A Continuous Predictive Architecture via Physical-Time Flow

ODEWorld:一种基于物理时间流的连续预测架构

Dongxiu Liu, Haoyi Niu, Peng Cheng, Yuan Gao, Xirui Kang, Sangli Teng, Koushil Sreenath, Xianyuan Zhan

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Berkeley Artificial Intelligence Research (BAIR), University of California, Berkeley(加州大学伯克利分校伯克利人工智能研究院(BAIR))

专题命中 机器人学习 :world model(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究针对现有世界建模机器学习范式局限于离散时间预测的问题,提出基于PT-Flow的连续时间潜在世界模型ODEWorld,解决表示崩溃问题,在视频生成和机器人控制任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13197 2026-06-16 cs.RO cs.CV cs.LG 版本更新 75%

Imitating What Works: Simulation-Filtered Modular Policy Learning from Human Videos

模仿有效的方法:基于仿真过滤的人类视频模块化策略学习

Albert J. Zhai, Kuo-Hao Zeng, Jiasen Lu, Ali Farhadi, Shenlong Wang, Wei-Chiu Ma

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Allen Institute for AI(Allen人工智能研究所) University of Washington(华盛顿大学) Cornell University(康奈尔大学)

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出Perceive-Simulate-Imitate框架,通过仿真过滤人类视频中的抓取-轨迹对,学习任务导向的抓取与后抓取运动策略,无需机器人数据即可实现鲁棒操作。

Comments Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04671 2026-04-16 cs.RO cs.AI cs.CV 75%

X-Diffusion: Training Diffusion Policies on Cross-Embodiment Human Demonstrations

X-Diffusion:在跨具身人类示范上训练扩散策略

Maximus A. Pace, Prithwish Dan, Chuanruo Ning, Atiksh Bhardwaj, Audrey Du, Edward W. Duan, Wei-Chiu Ma, Kushal Kedia

机构 * Cornell University(康奈尔大学)

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出X-Diffusion框架,通过在噪声人类动作上训练扩散策略,提升机器人任务成功率16%。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04225 2026-04-07 cs.LG cs.AI cs.RO cs.SY eess.SY 75%

Learning from Imperfect Demonstrations via Temporal Behavior Tree-Guided Trajectory Repair

通过时间行为树引导轨迹修复学习不完美的示范

Aniruddh G. Puranic, Sebastian Schirmer, John S. Baras, Calin Belta

专题命中 机器人学习 :robot learning(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出利用时间行为树修复不完美示范轨迹,以提升机器人控制策略的学习效果,通过生成逻辑一致且可解释的数据集,指导强化学习 agent 向任务一致的 state space 区域发展。

Comments 12 pages, 4 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18487 2026-02-17 cs.RO cs.CV cs.LG 75%

Grounding Bodily Awareness in Visual Representations for Efficient Policy Learning

在视觉表示中 grounding 身体意识以实现高效的策略学习

Junlin Wang, Zhiyun Lin

机构 * SUSTech Shenzhen(深圳科技大学)

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出ICon方法,通过对比学习提升机器人操作中策略学习的效率和跨机器人迁移能力。

Comments A preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23285 2026-02-02 cs.RO cs.AI cs.HC cs.LG 75%

End-to-end Optimization of Belief and Policy Learning in Shared Autonomy Paradigms

端到端优化信念与策略学习在共享自主性范式中的应用

MH Farhadi, Ali Rabiee, Sima Ghafoori, Anna Cetera, Andrew Fisher, Reza Abiri

机构 * University of Rhode Island(罗德岛大学)

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 BRACE框架通过整合信念信息与策略学习,提升了机器人在复杂目标模糊场景中的自主性和效率,实现了更高的成功率和路径效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01583 2025-10-07 cs.RO cs.AI cs.CV 75%

FreqPolicy: Frequency Autoregressive Visuomotor Policy with Continuous Tokens

Yiming Zhong, Yumeng Liu, Chuyang Xiao, Zemin Yang, Youzhuo Wang, Yufei Zhu, Ye Shi, Yujing Sun, Xinge Zhu, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) The University of Hong Kong(香港大学) Digital Trust Centre, Nanyang Technological University(南洋理工大学数字信任中心) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

Comments Comments: Published at Neural Information Processing Systems (NeurIPS) 2025. Project page and code: https://freq-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04535 2025-09-08 cs.RO cs.AI cs.LG 75%

In-Context Policy Adaptation via Cross-Domain Skill Diffusion

Minjong Yoo, Woo Kyung Kim, Honguk Woo

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments 9 pages

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12371 2025-03-12 cs.RO cs.AI cs.LG 75%

IMLE Policy: Fast and Sample Efficient Visuomotor Policy Learning via Implicit Maximum Likelihood Estimation

Krishan Rana, Robert Lee, David Pershouse, Niko Suenderhauf

专题命中 机器人学习 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Videos and code are available at https://imle-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18768 2025-02-12 cs.AI cs.LG cs.RO cs.SY eess.SY 75%

Learning from Demonstration with Implicit Nonlinear Dynamics Models

Peter David Fagan, Subramanian Ramamoorthy

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10395 2025-01-22 cs.LG cs.AI cs.RO 75%

Towards General Purpose Robots at Scale: Lifelong Learning and Learning to Use Memory

William Yue

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 机器人学习 :robotics(abstract);robot learning(abstract);分类 cs.RO、cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2401.02576, arXiv:2411.07954

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01903 2024-11-01 cs.LG cs.AI cs.CV 75%

Text-Aware Diffusion for Policy Learning

Calvin Luo, Mandy He, Zilai Zeng, Chen Sun

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23382 2024-11-01 cs.LG cs.AI cs.RO 75%

Estimating Neural Network Robustness via Lipschitz Constant and Architecture Sensitivity

Abulikemu Abuduweili, Changliu Liu

专题命中 机器人学习 :robot learning(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments SAFE-ROL at CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11598 2024-03-29 cs.RO cs.CV cs.LG 75%

SkillDiffuser: Interpretable Hierarchical Planning via Skill Abstractions in Diffusion-Based Task Execution

Zhixuan Liang, Yao Mu, Hengbo Ma, Masayoshi Tomizuka, Mingyu Ding, Ping Luo

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Accepted by CVPR 2024. Camera ready version. Project page: https://skilldiffuser.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00823 2024-03-22 cs.LG cs.AI cs.RO 75%

SLIM: Skill Learning with Multiple Critics

David Emukpere, Bingbing Wu, Julien Perez, Jean-Michel Renders

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Accepted at IEEE ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04115 2024-03-11 cs.RO cs.AI cs.CV 75%

DNAct: Diffusion Guided Multi-Task 3D Policy Learning

Ge Yan, Yueh-Hua Wu, Xiaolong Wang

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18759 2024-03-07 cs.RO cs.AI cs.LG 75%

Learning with Language-Guided State Abstractions

Andi Peng, Ilia Sucholutsky, Belinda Z. Li, Theodore R. Sumers, Thomas L. Griffiths, Jacob Andreas, Julie A. Shah

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02728 2023-10-05 cs.LG cs.AI cs.RO 75%

Hierarchical Empowerment: Towards Tractable Empowerment-Based Skill Learning

Andrew Levy, Sreehari Rammohan, Alessandro Allievi, Scott Niekum, George Konidaris

专题命中 机器人学习 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Additional baseline comparisons

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.08981 2022-03-11 cs.LG cs.AI cs.RO 75%

Hierarchical Few-Shot Imitation with Skill Transition Models

Kourosh Hakhamaneshi, Ruihan Zhao, Albert Zhan, Pieter Abbeel, Michael Laskin

专题命中 机器人学习 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.00137 2021-09-02 cs.RO cs.CV cs.LG 75%

Implicit Behavioral Cloning

Pete Florence, Corey Lynch, Andy Zeng, Oscar Ramirez, Ayzaan Wahid, Laura Downs, Adrian Wong, Johnny Lee, Igor Mordatch, Jonathan Tompson

专题命中 机器人学习 :robot policy(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.09107 2021-03-29 cs.RO cs.CV cs.LG 75%

Learning from Demonstration with Weakly Supervised Disentanglement

Yordan Hristov, Subramanian Ramamoorthy

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

Comments 18 pages, 16 figures, accepted at the International Conference on Learning Representations (ICLR) 2021, supplementary website at https://sites.google.com/view/weak-label-lfd

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.09558 2018-09-26 cs.RO cs.CV cs.LG 75%

Human-Machine Interface for Remote Training of Robot Tasks

Jordi Spranger, Roxana Buzatoiu, Athanasios Polydoros, Lazaros Nalpantidis, Evangelos Boukas

专题命中 机器人学习 :robotics(abstract);robot learning(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Accepted in IEEE International Conference on Imaging Systems and Techniques - IST2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.01813 2018-03-16 cs.AI cs.LG cs.RO 75%

Neural Task Programming: Learning to Generalize Across Hierarchical Tasks

Danfei Xu, Suraj Nair, Yuke Zhu, Julian Gao, Animesh Garg, Li Fei-Fei, Silvio Savarese

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICRA 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.07979 2018-03-06 cs.RO cs.AI cs.LG 75%

Multi-task Learning with Gradient Guided Policy Specialization

Wenhao Yu, C. Karen Liu, Greg Turk

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1610.01685 2016-10-07 cs.RO cs.CV cs.LG 75%

Supervision via Competition: Robot Adversaries for Learning Tasks

Lerrel Pinto, James Davidson, Abhinav Gupta

专题命中 机器人学习 :robotics(abstract);robot learning(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Submission to ICRA 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09882 2026-05-28 cs.RO cs.AI 74%

Emerging Extrinsic Dexterity in Cluttered Scenes via Dynamics-aware Policy Learning

杂乱场景中通过动力学感知策略学习涌现的外在灵巧性

Yixin Zheng, Jiangran Lyu, Yifan Zhang, Jiayi Chen, Mi Yan, Yuntian Deng, Xuesong Shi, Xiaoguang Zhao, Yizhou Wang, Zhizheng Zhang, He Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Galbot Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人学习 :manipulation(abstract);world model(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 提出动力学感知策略学习框架,通过显式世界建模学习接触诱导物体动力学表示并用于强化学习,使杂乱场景中的外在灵巧性无需手工启发式或复杂奖励塑造即可涌现。

Comments Accepted to Robotics: Science and Systems (RSS) 2026. Project page: https://pku-epic.github.io/DAPL/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22695 2025-09-30 cs.RO cs.CV 74%

ReSeFlow: Rectifying SE(3)-Equivariant Policy Learning Flows

Zhitao Wang, Yanke Wang, Jiangtao Wen, Roberto Horowitz, Yuxing Han

机构 * Tsinghua University, Shenzhen International Graduate School, Shenzhen, China(清华大学深圳国际研究生院,深圳,中国) College of Professional and Continuing Education (CPCE), The Hong Kong Polytechnic University (PolyU)(香港理工大学(PolyU)专业及继续教育学院) NYU Shanghai, China(纽约大学上海学院,中国) Department of Mechanical Engineering, University of California, Berkeley, USA(加州大学伯克利分校机械工程系)

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

Comments This work was submitted to 2026 IEEE International Conference on Robotics & Automation

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00490 2025-05-02 cs.RO cs.AI 74%

Optimal Interactive Learning on the Job via Facility Location Planning

Shivam Vats, Michelle Zhao, Patrick Callaghan, Mingxi Jia, Maxim Likhachev, Oliver Kroemer, George Konidaris

机构 * Brown University(布朗大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI;robotics(comments)

Comments Accepted to Robotics: Science and Systems (RSS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏