arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4131 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4131 篇

2505.19521 2025-06-02 cs.RO cs.LG cs.SY eess.SY 62%

Learning Dynamics under Environmental Constraints via Measurement-Induced Bundle Structures

Dongzhe Zheng, Wenjie Mei

机构 * Dongzhe Zheng Wenjie Mei

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22756 2025-05-30 cs.AI cs.CL cs.LG 62%

Decomposing Elements of Problem Solving: What "Math" Does RL Teach?

Tian Qin, Core Francisco Park, Mujin Kwun, Aaron Walsman, Eran Malach, Nikhil Anand, Hidenori Tanaka, David Alvarez-Melis

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20621 2025-05-28 cs.LG cs.AI 62%

Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning

Shijie Liu, Andrew C. Cullen, Paul Montague, Sarah Erfani, Benjamin I. P. Rubinstein

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院) Defence Science and Technology Group(国防科学与技术集团)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20350 2025-05-28 cs.LG cs.AI 62%

Decision Flow Policy Optimization

Jifeng Hu, Sili Huang, Siyuan Guo, Zhaogeng Liu, Li Shen, Lichao Sun, Hechang Chen, Yi Chang, Dacheng Tao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19867 2025-05-27 cs.LG cs.AI 62%

Deep Active Inference Agents for Delayed and Long-Horizon Environments

Yavar Taheri Yeganeh, Mohsen Jafari, Andrea Matta

机构 * Politecnico di Milano(米兰理工学院) Rutgers University(罗切斯特大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12701 2025-05-20 cs.LG cs.AI 62%

Counterfactual Explanations for Continuous Action Reinforcement Learning

Shuyang Dong, Shangtong Zhang, Lu Feng

机构 * University of Virginia(弗吉尼亚大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted by International Joint Conference on Artificial Intelligence (IJCAI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19989 2025-05-16 cs.RO cs.LG 62%

On-Robot Reinforcement Learning with Goal-Contrastive Rewards

Ondrej Biza, Thomas Weng, Lingfeng Sun, Karl Schmeckpeper, Tarik Kelestemur, Yecheng Jason Ma, Robert Platt, Jan-Willem van de Meent, Lawson L. S. Wong

机构 * Robotics and AI Institute(机器人与人工智能研究所) Northeastern University(东北大学) Khoury College of Computer Sciences(计算机科学学院) University of Pennsylvania(宾夕法尼亚大学) University of Amsterdam(阿姆斯特丹大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09546 2025-05-15 cs.RO cs.LG 62%

Distilling Realizable Students from Unrealizable Teachers

Yujin Kim, Nathaniel Chin, Arnav Vasudev, Sanjiban Choudhury

机构 * Department of Computer Science, Cornell University(计算机科学系,康奈尔大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08453 2025-05-14 cs.RO cs.LG 62%

Parameter Estimation using Reinforcement Learning Causal Curiosity: Limits and Challenges

Miguel Arana-Catania, Weisi Guo

机构 * Digital Scholarship at Oxford(牛津大学数字人文中心) University of Oxford(牛津大学) Faculty of Engineering and Applied Sciences(工程与应用科学学院) Cranfield University(克兰菲尔德大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 24 pages, 10 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07911 2025-05-14 cs.LG cs.AI 62%

Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review

Chengmin Zhou, Ville Kyrki, Pasi Fränti, Laura Ruotsalainen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.11111 2025-05-13 cs.LG cs.AI cs.SY eess.SY 62%

The Pump Scheduling Problem: A Real-World Scenario for Reinforcement Learning

Henrique Donâncio, Laurent Vercouter, Harald Roclawski

机构 * Normandie Université(诺曼底大学) INSA Rouen(里昂大学鲁昂分校) LITIS Rouen(鲁昂LITIS研究所) Technical University of Kaiserslautern(凯撒斯劳滕技术大学) SAM Kaiserlaustern(凯撒斯劳滕SAM)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06300 2025-05-13 cs.LG cs.AI 62%

ARDNS-FN-Quantum: A Quantum-Enhanced Reinforcement Learning Framework with Cognitive-Inspired Adaptive Exploration for Dynamic Environments

Umberto Gonçalves de Sousa

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01619 2025-05-06 cs.LG cs.AI 62%

Skill-based Safe Reinforcement Learning with Risk Planning

Hanping Zhang, Yuhong Guo

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02788 2025-05-01 cs.RO cs.AI 62%

When to Localize? A Risk-Constrained Reinforcement Learning Approach

Chak Lam Shek, Kasra Torshizi, Troi Williams, Pratap Tokekar

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05341 2025-04-28 cs.NE cs.AI cs.LG 62%

Three-Factor Learning in Spiking Neural Networks: An Overview of Methods and Trends from a Machine Learning Perspective

Szymon Mazurek, Jakub Caputa, Jan K. Argasiński, Maciej Wielgosz

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05996 2025-04-15 cs.RO cs.AI 62%

Motion Control in Multi-Rotor Aerial Robots Using Deep Reinforcement Learning

Gaurav Shetty, Mahya Ramezani, Hamed Habibi, Holger Voos, Jose Luis Sanchez-Lopez

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06683 2025-04-10 cs.LG cs.AI 62%

Hyperparameter Optimisation with Practical Interpretability and Explanation Methods in Probabilistic Curriculum Learning

Llewyn Salt, Marcus Gallagher

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03800 2025-04-08 cs.LG cs.AI cs.NE 62%

Decision SpikeFormer: Spike-Driven Transformer for Decision Making

Wei Huang, Qinying Gu, Nanyang Ye

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.LG

Comments This work has been accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01459 2025-04-03 cs.LG cs.AI 62%

Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning

Llewyn Salt, Marcus Gallagher

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01336 2025-04-03 cs.RO cs.LG 62%

Inverse RL Scene Dynamics Learning for Nonlinear Predictive Control in Autonomous Vehicles

Sorin Grigorescu, Mihai Zaha

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 21 pages, 14 figures, journal paper

Journal ref IEEE Transactions on Neural Networks and Learning Systems, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18816 2025-03-31 cs.RO cs.AI 62%

Learning Multi-Robot Coordination through Locality-Based Factorized Multi-Agent Actor-Critic Algorithm

Chak Lam Shek, Amrit Singh Bedi, Anjon Basak, Ellen Novoseller, Nick Waytowich, Priya Narayanan, Dinesh Manocha, Pratap Tokekar

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20613 2025-03-27 cs.LG cs.AI cs.NI cs.SY eess.SY 62%

State-Aware Perturbation Optimization for Robust Deep Reinforcement Learning

Zongyuan Zhang, Tianyang Duan, Zheng Lin, Dong Huang, Zihan Fang, Zekai Sun, Ling Xiong, Hongbin Liang, Heming Cui, Yong Cui

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20078 2025-03-27 cs.LG cs.AI cs.MA 62%

Abstracting Geo-specific Terrains to Scale Up Reinforcement Learning

Volkan Ustun, Soham Hans, Rajay Kumar, Yunzhe Wang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 6 figures, 2024 Interservice/Industry Training, Simulation, and Education Conference (I/ITSEC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19007 2025-03-26 cs.LG cs.AI 62%

Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning

Chak Lam Shek, Pratap Tokekar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17432 2025-03-25 eess.SY cs.LG cs.RO cs.SY 62%

TamedPUMA: safe and stable imitation learning with geometric fabrics

Saray Bakker, Rodrigo Pérez-Dattari, Cosimo Della Santina, Wendelin Böhmer, Javier Alonso-Mora

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 14 pages (10+4), 1+3*5 figures, 1 table, preprint version of accepted paper at L4DC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05614 2025-03-25 cs.LG cs.AI 62%

Cross-domain Random Pre-training with Prototypes for Reinforcement Learning

Xin Liu, Yaran Chen, Haoran Li, Boyu Li, Dongbin Zhao

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12092 2025-03-19 cs.RO cs.AI 62%

IMRL: Integrating Visual, Physical, Temporal, and Geometric Representations for Enhanced Food Acquisition

Rui Liu, Zahiruddin Mahammad, Amisha Bhaskar, Pratap Tokekar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13171 2025-03-18 cs.RO cs.AI 62%

HybridGen: VLM-Guided Hybrid Planning for Scalable Data Generation of Imitation Learning

Wensheng Wang, Ning Tan

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09536 2025-03-18 cs.LG cs.RO 62%

TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement Learning

Ge Li, Dong Tian, Hongyi Zhou, Xinkai Jiang, Rudolf Lioutikov, Gerhard Neumann

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.LG

Comments Accepted as a Spotlight at ICLR 2025

Journal ref The Thirteenth International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11467 2025-03-17 cs.RO cs.LG 62%

Dynamic Obstacle Avoidance with Bounded Rationality Adversarial Reinforcement Learning

Jose-Luis Holgado-Alvarez, Aryaman Reddi, Carlo D'Eramo

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏