arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 874 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 874 篇

2512.11988 2026-04-21 cs.CV 57%

CARI4D: Category Agnostic 4D Reconstruction of Human-Object Interaction

CARI4D:类别无关的人-物体交互4D重建

Xianghui Xie, Bowen Wen, Yan Chang, Hesam Rabeti, Jiefeng Li, Ye Yuan, Gerard Pons-Moll, Stan Birchfield

机构 * NVIDIA University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 CARI4D提出了一种无需假设物体类别即可从单目RGB视频中重建人-物体交互的4D模型,通过姿态假设选择算法和渲染-比较方法提升重建精度与物理一致性。

Comments CVPR2026 camera ready version. Project page: https://nvlabs.github.io/CARI4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11251 2026-04-20 cs.RO 57%

CLAW: Composable Language-Annotated Whole-body Motion Generation

CLAW:可组合的语言标注全身运动生成

Jianuo Cao, Yuxin Chen, Masayoshi Tomizuka

机构 * Nanjing University(南京大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 CLAW通过结合运动规划和模板引擎,为Unitree G1人形机器人生成可扩展的语言标注全身运动数据,提供实时键盘模式和时间轴序列编辑器,实现物理可行的运动轨迹生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19054 2026-04-16 cs.LG 57%

RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning

RANDPOL: 通过随机策略学习实现参数高效的端到端四足运动

Zhuochen Liu, Rahul Jain, Quan Nguyen

机构 * Ming Hsieh Department of Electrical and Computer Engineering, University of Southern California(明希德电气与计算机工程系,南加州大学) Department of Aerospace & Mechanical Engineering, University of Southern California(航空航天与机械工程系,南加州大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.LG

AI总结 本文提出RANDPOL,一种通过随机初始化隐藏层实现参数高效端到端四足运动控制的方法,相比PPO在参数量、计算效率和性能-复杂度平衡上表现更优。

Comments 6 pages main, 7 pages total, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19029 2026-03-20 cs.RO 57%

ATG-MoE: Autoregressive trajectory generation with mixture-of-experts for assembly skill learning

ATG-MoE:基于混合专家的自主轨迹生成用于装配技能学习

Weihang Huang, Chaoran Zhang, Xiaoxin Deng, Hao Zhou, Zhaobo Xu, Shubo Cui, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Faculty of Engineering, Imperial College London(伦敦帝国理工学院工程学院)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 本文提出ATG-MoE,通过混合专家架构实现多技能整合,解决传统方法在多阶段设计和多技能整合能力上的不足,实验显示其在模拟和实际应用中均表现优异。

Comments 32 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17141 2026-03-17 cs.RO 57%

History-Aware Visuomotor Policy Learning via Point Tracking

基于点跟踪的视觉-运动政策学习:历史感知

Jingjing Chen, Hongjie Fang, Chenxi Wang, Shiquan Wang, Cewu Lu

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 本文提出基于点跟踪的对象中心历史表示,通过压缩历史信息提升视觉-运动策略性能,有效解决记忆需求中的任务阶段识别、空间记忆和动作计数等多方面问题。

Comments accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01480 2026-03-03 cs.RO 57%

Towards Robot Skill Learning and Adaptation with Gaussian Processes

基于高斯过程的机器人技能学习与适应

A K M Nadimul Haque, Fouad Sukkar, Sheila Sujipto, Cedric Le Gentil, Marc G. Carmichael, Teresa Vidal-Calleja

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 本文提出基于高斯过程的机器人技能适应框架,通过优化、行为克隆和强化学习方法,在模拟和硬件上实现高成功率和运动学轮廓保持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19391 2026-02-16 cs.CV 57%

Fibottention: Inceptive Visual Representation Learning with Diverse Attention Across Heads

Fibottention: 基于多头注意力的视觉表征学习

Ali K. Rahimian, Manish K. Govind, Subhajit Maity, Dominick Reilly, Christian Kümmerle, Srijan Das, Aritra Dutta

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) University of Central Florida(佛罗里达大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 Fibottention通过引入稀疏自注意力机制,实现高效视觉表征学习,减少计算复杂度并提升表示多样性。

Comments The complete implementation, including source code and evaluation scripts, is publicly available at: https://github.com/Charlotte-CharMLab/Fibottention

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11393 2026-02-13 cs.RO 57%

Human Preference Modeling Using Visual Motion Prediction Improves Robot Skill Learning from Egocentric Human Video

通过视觉运动预测建模的人类偏好改进从第一人称人类视频中学习机器人技能

Mrinal Verghese, Christopher G. Atkeson

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 通过视觉运动预测建模人类偏好,改进机器人从第一人称视频学习技能

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10109 2026-02-11 cs.RO 57%

ST4VLA: Spatially Guided Training for Vision-Language-Action Models

ST4VLA:基于空间引导的视觉-语言-动作模型训练

Jinhui Ye, Fangjing Wang, Ning Gao, Junqiu Yu, Yangkun Zhu, Bin Wang, Jinyu Zhang, Weiyang Jin, Yanwei Fu, Feng Zheng, Yilun Chen, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology(香港科技大学) Southern University of Science and Technology(南方科技大学) Fudan University(复旦大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 ST4VLA通过空间引导训练提升视觉-语言-动作模型的性能,实现对机器人任务的更稳健和可泛化的学习。

Comments Spatially Training for VLA, Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03188 2026-02-04 cs.RO 57%

Hierarchical Proportion Models for Motion Generation via Integration of Motion Primitives

基于运动原语整合的分层比例模型用于运动生成

Yu-Han Shu, Toshiaki Tsuji, Sho Sakaino

机构 * Intelligent and Mechanical Interaction Systems(智能与机械交互系统) University of Tsukuba(东京大学) Science and Engineering(科学与工程) Saitama University(上野大学) Systems and Information Engineering(系统与信息工程)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 本文提出了一种基于运动原语整合的分层比例模型,通过整合比例基于的运动合成提升机器人运动生成的效率和适应性。

Comments 6 pages, 9 figures. Accepted for publication in IEEE AMC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00350 2026-02-03 cs.CV 57%

ReLAPSe: Reinforcement-Learning-trained Adversarial Prompt Search for Erased concepts in unlearned diffusion models

ReLAPSe: 通过强化学习训练的对抗性提示搜索消除未学习扩散模型中的擦除概念

Ignacy Kolton, Kacper Marzol, Paweł Batorski, Marcin Mazur, Paul Swoboda, Przemysław Spurek

机构 * Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS研究机构)

专题命中 机器人学习 :manipulation(abstract);分类 cs.CV

AI总结 ReLAPSe通过强化学习训练对抗性提示搜索,有效恢复扩散模型中被移除的概念,提供高效的去学习测试工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17253 2025-12-22 cs.CV 57%

Mitty: Diffusion-based Human-to-Robot Video Generation

Mitty:基于扩散的Human-to-Robot视频生成

Yiren Song, Cheng Liu, Weijia Mao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 Mitty通过基于扩散的变换器实现端到端的人机视频生成,利用预训练模型和双向注意力机制,无需动作标签或中间抽象,生成高质量的机器人执行视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15715 2025-12-18 cs.CV 57%

In Pursuit of Pixel Supervision for Visual Pre-training

追寻像素监督用于视觉预训练

Lihe Yang, Shang-Wen Li, Yang Li, Xinjie Lei, Dong Wang, Abdelrahman Mohamed, Hengshuang Zhao, Hu Xu

机构 * FAIR, Meta(Meta研究院)

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 Pixio通过增强的掩码自编码器实现像素监督的视觉预训练,表现优异于DINOv3,适用于多种下游任务。

Comments Project page: https://github.com/facebookresearch/pixio

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13707 2025-12-16 cs.RO 57%

Human-Like Robot Impedance Regulation Skill Learning from Human-Human Demonstrations

类人机器人阻抗调节技能从人与人示范中学习

Chenzui Li, Xi Wu, Yiming Chen, Tao Teng, Xuefeng Zhang, Sylvain Calinon, Darwin Caldwell, Fei Chen

机构 * Department of Mechanical and Automation Engineering, T-Stone Robotics Institute, The Chinese University of Hong Kong(机械与自动化工程系,T-Stone机器人研究院,香港中文大学) College of Science and Technology, Ningbo University(科学与技术学院,宁波大学) Idiap Research Institute(Idiap研究机构)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出HIImpRSL框架,通过模仿学习和LSTM模块实现机器人在多人协作任务中类人阻抗调节与适应能力。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23823 2025-12-10 cs.RO 57%

Control Your Robot: A Unified System for Robot Control and Policy Deployment

掌控你的机器人:一种统一的机器人控制与策略部署系统

Tian Nian, Weijie Ke, Shaolong Zhu, Bingshan Hu

机构 * ScaleLab, Shanghai Jiao Tong University(上海交通大学ScaleLab) University of Shanghai for Science and Technology(上海科学技术大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 Control Your Robot提出了一种统一的机器人控制与策略部署框架,通过模块化设计和标准化流程,实现跨平台的数据收集与策略学习,提升机器人学习的可扩展性和可重复性。

Comments Code: https://github.com/Tian-Nian/control_your_robot

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14434 2025-11-19 cs.RO cs.LO 57%

Achieving Safe Control Online through Integration of Harmonic Control Lyapunov-Barrier Functions with Unsafe Object-Centric Action Policies

Marlow Fawn, Matthias Scheutz

机构 * Human-Robot Interaction Laboratory(人机交互实验室) Tufts University(塔夫茨大学) MA 02155, USA(马萨诸塞州02155, 美国)

专题命中 机器人学习 :robot policy(abstract);分类 cs.RO

Comments In Proceedings FMAS 2025, arXiv:2511.13245

Journal ref EPTCS 436, 2025, pp. 69-79

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13922 2025-11-11 cs.RO 57%

DynaGuide: Steering Diffusion Polices with Active Dynamic Guidance

Maximilian Du, Shuran Song

机构 * Stanford University(斯坦福大学)

专题命中 机器人学习 :robot policy(abstract);分类 cs.RO

Comments 9 pages main, 21 pages with appendix and citations. 9 figures. Presented at Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14305 2025-10-28 cs.RO 57%

Adversarial Locomotion and Motion Imitation for Humanoid Policy Learning

Jiyuan Shi, Xinzhe Liu, Dewei Wang, Ouyang Lu, Sören Schwertfeger, Chi Zhang, Fuchun Sun, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) ShanghaiTech University(上海科技大学) University of Science and Technology of China(中国科学技术大学) Northwestern Polytechnical University(西北工业大学) Tsinghua University(清华大学)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

Comments NeurIPS 2025. Code: https://github.com/TeleHuman/ALMI-Open, Dataset: https://huggingface.co/datasets/TeleEmbodied/ALMI-X

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18137 2025-10-22 cs.RO 57%

Quality Over Quantity: Curating Contact-Based Robot Datasets Improves Learning

Hrishikesh Sathyanarayan, Victor Vantilborgh, Ian Abraham

机构 * Department of Mechanical Engineering, Yale University(耶鲁大学机械工程系) Department of Electromechanical, Systems and Metal Engineering, Ghent University(根特大学机电系统与金属工程系)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03081 2025-10-06 cs.RO 57%

Embracing Evolution: A Call for Body-Control Co-Design in Embodied Humanoid Robot

Guiliang Liu, Bo Yue, Yi Jin Kim, Kui Jia

机构 * The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) DexForce Technology(DexForce技术)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12562 2025-09-17 cs.RO 57%

Robust Online Residual Refinement via Koopman-Guided Dynamics Modeling

Zhefei Gong, Shangke Lyu, Pengxiang Ding, Wei Xiao, Donglin Wang

机构 * Westlake University(西湖大学) Nanjing University(南京大学) Zhejiang University(浙江大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08241 2025-09-11 cs.RO cs.SY eess.SY 57%

Sample-Efficient Online Control Policy Learning with Real-Time Recursive Model Updates

Zixin Zhang, James Avtges, Todd D. Murphey

专题命中 机器人学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19953 2025-09-01 cs.RO 57%

Divide, Discover, Deploy: Factorized Skill Learning with Symmetry and Style Priors

Rafael Cathomen, Mayank Mittal, Marin Vlastelica, Marco Hutter

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO

Comments Accepted to CoRL 2025. For code and videos, please check: https://leggedrobotics.github.io/d3-skill-discovery/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19684 2025-08-28 cs.RO physics.app-ph 57%

Embodied Intelligence for Sustainable Flight: A Soaring Robot with Active Morphological Control

Ghadeer Elmkaiel, Syn Schmitt, Michael Muehlebach

机构 * Learning and Dynamical Systems, Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所学习与动力系统部门) Institute for Modelling and Simulation of Biomechanical Systems, University of Stuttgart(斯图加特大学生物力学系统建模与仿真研究所)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.02018 2025-08-26 eess.SY cs.RO cs.SY 57%

Constrained Trajectory Optimization on Matrix Lie Groups via Lie-Algebraic Differential Dynamic Programming

Gokhan Alcan, Fares J. Abu-Dakka, Ville Kyrki

机构 * Mechanical Engineering, Tampere University, Finland(塔尔库大学机械工程系) Mechanical Engineering Program, Division of Engineering, New York University Abu Dhabi, United Arab Emirates(纽约大学阿布扎克分校工程学院机械工程项目) Department of Electrical Engineering(电气工程系) Automation, Aalto University, Finland(自动化,艾尔沃斯大学)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11571 2025-08-21 cs.RO 57%

SDS -- See it, Do it, Sorted: Quadruped Skill Synthesis from Single Video Demonstration

Maria Stamatopoulou, Jeffrey Li, Dimitrios Kanoulas

机构 * Robot Perception Lab, University College London, United Kingdom(伦敦大学学院机器人感知实验室)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08743 2025-08-13 cs.RO 57%

Boosting Action-Information via a Variational Bottleneck on Unlabelled Robot Videos

Haoyu Zhang, Long Cheng

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03660 2025-08-06 cs.LG 57%

Efficient Morphology-Aware Policy Transfer to New Embodiments

Michael Przystupa, Hongyao Tang, Martin Jagersand, Santiago Miret, Mariano Phielipp, Matthew E. Taylor, Glen Berseth

专题命中 机器人学习 :robotics(abstract);分类 cs.LG

Comments 19 pages, 10 Figures, Published at the 2025 Reinforcement Learning Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15585 2025-07-15 cs.RO 57%

XMoP: Whole-Body Control Policy for Zero-shot Cross-Embodiment Neural Motion Planning

Prabin Kumar Rath, Nakul Gopalan

机构 * Arizona State University(亚利桑那州立大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

Comments Website at https://prabinrath.github.io/xmop Paper has 17 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14191 2025-05-21 cs.RO 57%

A Probabilistic Model for Skill Acquisition with Switching Latent Feedback Controllers

Juyan Zhang, Dana Kulic, Michael Burke

机构 * Department of Electrical and Computer Systems Engineering Faculty of Engineering(电气与计算机系统工程系工程学院)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏