arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 874 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 874 篇

2605.16054 2026-05-18 cs.LG cs.AI 62%

Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making

Ada-Diffuser: 面向决策制定的潜在意识自适应扩散模型

Fan Feng, Selena Ge, Minghao Fu, Zijian Li, Yujia Zheng, Zeyu Tang, Yingyao Hu, Biwei Huang, Kun Zhang

机构 * University of California San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学) MBZUAI Stanford University(斯坦福大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Ada-Diffuser,通过显式建模潜在动态过程,提升决策制定的精度与适应性,实验验证其在模拟控制与机器人基准中的有效性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15281 2026-04-17 cs.CV cs.RO 62%

R3D: Revisiting 3D Policy Learning

R3D:重新审视3D策略学习

Zhengdong Hong, Shenrui Wu, Haozhe Cui, Boyi Zhao, Ran Ji, Yiyang He, Hangxing Zhang, Zundong Ke, Jun Wang, Guofeng Zhang, Jiayuan Gu

机构 * Zhejiang University(浙江大学) ShanghaiTech University(上海科技大学)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文针对3D策略学习中的训练不稳定和过拟合问题,提出结合可扩展的Transformer3D编码器与扩散解码器的新架构,有效提升3D模仿学习的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03166 2026-03-31 cs.RO cs.AI cs.CL 62%

Continual Robot Skill and Task Learning via Dialogue

通过对话实现机器人持续技能和任务学习

Weiwei Gu, Suresh Kondepudi, Anmol Gupta, Lixiao Huang, Nakul Gopalan

机构 * Arizona State University(亚利桑那州立大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.AI

AI总结 本文提出通过对话交互实现机器人持续学习任务和视觉-运动技能,开发了ACT-LoRA政策在模拟中优于基线,且在真实场景中成功教授烹饪技能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13438 2026-03-17 cs.CV cs.AI 62%

Draft-and-Target Sampling for Video Generation Policy

视频生成策略的草稿与目标采样

Qikang Zhang, Yingjie Lei, Wei Liu, Daochang Liu

机构 * South China Normal University(华南师范大学) University of Western Australia(西澳大学)

专题命中 机器人学习 :robot policy(abstract);分类 cs.AI、cs.CV

AI总结 本文提出一种无训练的扩散推理范式,通过自play去噪方法提升视频生成效率,实验表明在三个基准上实现2.1倍加速,同时保持高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18603 2026-02-24 cs.RO cs.LG 62%

Enhancing Goal Inference via Correction Timing

通过纠正时机增强目标推断

Anjiabei Wang, Shuangge Wang, Tesca Fitzgerald

机构 * Yale University(耶鲁大学)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.LG

AI总结 通过分析纠正时机,研究其在机器人学习中的应用,提升目标推断和任务约束学习效果。

Comments 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04118 2026-02-05 cs.LG cs.AI cs.CL 62%

Policy Learning with a Language Bottleneck

具有语言瓶颈的策略学习

Megha Srivastava, Cedric Colas, Dorsa Sadigh, Jacob Andreas

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) Inria(法国国家信息与自动化技术研究院)

专题命中 机器人学习 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 通过语言瓶颈框架,AI代理能生成可解释的策略规则,提升与人类的协作效率。

Comments Accepted to TMLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23928 2025-12-30 cs.RO cs.CV 62%

Adaptive Keyframe Selection for Scalable 3D Scene Reconstruction in Dynamic Environments

动态环境中可扩展3D场景重建的自适应关键帧选择

Raman Jha, Yang Zhou, Giuseppe Loianno

机构 * Department of Electrical and Computer Engineering, New York University, Brooklyn, NY 11201, USA(电气与计算机工程系,纽约大学,布鲁克林,NY 11201, USA) Department of Electrical Engineering and Computer Sciences, University of California, Berkeley, CA 94720, USA(电气工程与计算机科学系,加州大学伯克利分校,CA 94720, USA)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.CV

AI总结 本文提出自适应关键帧选择方法,通过动态调整阈值提升动态环境中3D场景重建质量,实验验证其在Spann3r和CUT3R网络中的有效性。

Comments Accepted at ROBOVIS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21121 2025-10-27 cs.RO cs.AI 62%

Generalizable Hierarchical Skill Learning via Object-Centric Representation

Haibo Zhao, Yu Qi, Boce Hu, Yizhe Zhu, Ziyan Chen, Heng Tian, Xupeng Zhu, Owen Howell, Haojie Huang, Robin Walters, Dian Wang, Robert Platt

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02268 2025-10-03 cs.RO cs.CV 62%

Do You Know Where Your Camera Is? View-Invariant Policy Learning with Camera Conditioning

Tianchong Jiang, Jingtian Ji, Xiangshan Tan, Jiading Fang, Anand Bhattad, Vitor Guizilini, Matthew R. Walter

机构 * Toyota Technological Institute at Chicago(丰田技术研究所芝加哥分所) Waymo Johns Hopkins University(约翰霍普金斯大学) Toyota Research Institute(丰田研究院)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.CV

Comments Code and project materials are available at ripl.github.io/know_your_camera

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19204 2025-08-27 cs.CV cs.AI cs.GR 62%

LSD-3D: Large-Scale 3D Driving Scene Generation with Geometry Grounding

Julian Ost, Andrea Ramazzina, Amogh Joshi, Maximilian Bömer, Mario Bijelic, Felix Heide

机构 * Julian Ost(未知) Andrea Ramazzina(未知) Amogh Joshi(未知) Maximilian Bömer(未知) Mario Bijelic(未知) Felix Heide(未知)

专题命中 机器人学习 :robot learning(abstract);分类 cs.AI、cs.CV

Comments Project webpage: https://light.princeton.edu/LSD-3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06782 2025-08-12 cs.RO cs.CV 62%

CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction

Zhefei Gong, Pengxiang Ding, Shangke Lyu, Siteng Huang, Mingyang Sun, Wei Zhao, Zhaoxin Fan, Donglin Wang

机构 * Westlake University(西湖大学) Zhejiang University(浙江大学) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03944 2025-08-07 cs.RO cs.AI 62%

Constraint-Preserving Data Generation for Visuomotor Policy Learning

Kevin Lin, Varun Ragunath, Andrew McAlinden, Aaditya Prasad, Jimmy Wu, Yuke Zhu, Jeannette Bohg

机构 * Stanford University(斯坦福大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Princeton University(普林斯顿大学)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.AI

Comments CoRL 2025. Website: https://cp-gen.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15958 2025-07-02 physics.flu-dyn cs.LG cs.RO 62%

Contactless Precision Steering of Particles in a Fluid inside a Cube with Rotating Walls

Lucas Amoudruz, Petr Karnakov, Petros Koumoutsakos

机构 * Computational Science and Engineering Laboratory, Harvard University(计算科学与工程实验室,哈佛大学)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.LG

Journal ref J. Fluid Mech. 1014 (2025) A15

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05026 2025-06-24 cs.LG cs.RO 62%

Active Fine-Tuning of Multi-Task Policies

Marco Bagatella, Jonas Hübotter, Georg Martius, Andreas Krause

机构 * Department of Computer Science, ETH Z\"urich, Z\"urich, Switzerland Max Planck Institute for Intelligent Systems, T\"ubingen, Germany University of T\"ubingen, T\"ubingen, Germany

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09342 2025-05-28 cs.RO cs.LG cs.SY eess.SY 62%

Diffusion Predictive Control with Constraints

Ralf Römer, Alexander von Rohr, Angela P. Schoellig

机构 * Technical University of Munich(慕尼黑技术大学) TUM School of Computation Information and Technology(TUM计算信息学院) Learning Systems and Robotics Lab(学习系统与机器人实验室) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted to L4DC 2025. Code: https://github.com/ralfroemer99/dpcc. 14 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20962 2025-05-28 cs.RO cs.CV 62%

Object-Centric Action-Enhanced Representations for Robot Visuo-Motor Policy Learning

Nikos Giannakakis, Argyris Manetas, Panagiotis P. Filntisis, Petros Maragos, George Retsinas

机构 * School of ECE, National Technical University of Athens(希腊国家技术大学电子工程学院) Robotics Institute, Athena Research Center(阿提卡研究中心机器人研究所) School of ECE, NTUA(希腊国家技术大学电子工程学院) HERON - Hellenic Robotics Center of Excellence(希腊机器人卓越中心)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13079 2025-05-23 cs.RO cs.AI 62%

Neural Internal Model Control: Learning a Robust Control Policy via Predictive Error Feedback

Feng Gao, Chao Yu, Yu Wang, Yi Wu

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Beijing Zhongguancun Academy(北京中关村学院)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO、cs.AI

Comments Accepted by RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00200 2025-04-28 cs.RO cs.CV 62%

Unified Video Action Model

Shuang Li, Yihuai Gao, Dorsa Sadigh, Shuran Song

机构 * Stanford University(斯坦福大学)

专题命中 机器人学习 :robotics(abstract);分类 cs.RO、cs.CV

Comments Project website: https://unified-video-action-model.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15139 2025-04-11 cs.CV cs.RO 62%

DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving

Bencheng Liao, Shaoyu Chen, Haoran Yin, Bo Jiang, Cheng Wang, Sixu Yan, Xinbang Zhang, Xiangyu Li, Ying Zhang, Qian Zhang, Xinggang Wang

专题命中 机器人学习 :robotic(abstract);分类 cs.RO、cs.CV

Comments Accepted to CVPR 2025 as Highlight. Code & demo & model are available at https://github.com/hustvl/DiffusionDrive

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19219 2025-04-08 cs.RO cs.AI 62%

Robot Behavior Personalization from Sparse User Feedback

Maithili Patel, Sonia Chernova

专题命中 机器人学习 :robot policy(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06359 2025-03-26 cs.RO cs.CV 62%

On-Device Self-Supervised Learning of Low-Latency Monocular Depth from Only Events

Jesse Hagenaars, Yilun Wu, Federico Paredes-Vallés, Stein Stroobants, Guido de Croon

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.CV

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03169 2024-11-06 cs.CV cs.LG 62%

Pre-trained Visual Dynamics Representations for Efficient Policy Learning

Hao Luo, Bohan Zhou, Zongqing Lu

专题命中 机器人学习 :robotics(abstract);分类 cs.CV、cs.LG

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15239 2024-10-14 cs.RO cs.LG 62%

Guided Decoding for Robot On-line Motion Generation and Adaption

Nutan Chen, Botond Cseke, Elie Aljalbout, Alexandros Paraschos, Marvin Alles, Patrick van der Smagt

专题命中 机器人学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments IEEE-RAS International Conference on Humanoid Robots, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18545 2024-09-30 cs.RO cs.AI cs.HC 62%

An Epistemic Human-Aware Task Planner which Anticipates Human Beliefs and Decisions

Shashank Shekhar, Anthony Favier, Rachid Alami

专题命中 机器人学习 :robot policy(abstract);分类 cs.RO、cs.AI

Comments 15 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00025 2024-07-15 cs.RO cs.CV 62%

Any-point Trajectory Modeling for Policy Learning

Chuan Wen, Xingyu Lin, John So, Kai Chen, Qi Dou, Yang Gao, Pieter Abbeel

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.CV

Comments 18 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16862 2024-06-25 cs.RO cs.CV 62%

Dreamitate: Real-World Visuomotor Policy Learning via Video Generation

Junbang Liang, Ruoshi Liu, Ege Ozguroglu, Sruthi Sudhakar, Achal Dave, Pavel Tokmakov, Shuran Song, Carl Vondrick

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO、cs.CV

Comments Project page: https://dreamitate.cs.columbia.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03228 2024-06-11 cs.LG cs.RO cs.SY eess.SY 62%

ISAACS: Iterative Soft Adversarial Actor-Critic for Safety

Kai-Chieh Hsu, Duy Phuong Nguyen, Jaime Fernández Fisac

专题命中 机器人学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Accepted in 5th Annual Learning for Dynamics & Control Conference (L4DC), University of Pennsylvania

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16354 2024-05-28 cs.LG cs.AI cs.CL 62%

Language-guided Skill Learning with Temporal Variational Inference

Haotian Fu, Pratyusha Sharma, Elias Stengel-Eskin, George Konidaris, Nicolas Le Roux, Marc-Alexandre Côté, Xingdi Yuan

专题命中 机器人学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13350 2024-01-22 cs.AI cs.LG 62%

Choreographer: Learning and Adapting Skills in Imagination

Pietro Mazzaglia, Tim Verbelen, Bart Dhoedt, Alexandre Lacoste, Sai Rajeswar

专题命中 机器人学习 :world model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICLR 2023 (notable top 25%)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01454 2023-11-03 cs.RO cs.AI 62%

NOIR: Neural Signal Operated Intelligent Robots for Everyday Activities

Ruohan Zhang, Sharon Lee, Minjune Hwang, Ayano Hiranaka, Chen Wang, Wensi Ai, Jin Jie Ryan Tan, Shreya Gupta, Yilun Hao, Gabrael Levine, Ruohan Gao, Anthony Norcia, Li Fei-Fei, Jiajun Wu

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏