arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4126 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4126 篇

2507.18883 2025-07-28 cs.AI cs.RO 62%

Success in Humanoid Reinforcement Learning under Partial Observation

Wuhao Wang, Zhiyong Chen

机构 * School of Engineering, The University of Newcastle(工程学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 11 pages, 3 figures, and 4 tables. Not published anywhere else

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17070 2025-07-24 cs.LG cs.AI 62%

Advancing Robustness in Deep Reinforcement Learning with an Ensemble Defense Approach

Adithya Mohan, Dominik Rößle, Daniel Cremers, Torsten Schön

机构 * AImotion Bavaria, Technische Hochschule Ingolstadt(巴伐利亚AImotion、英格尔施泰特技术大学) School of Computation, Information and Technology, TU Munich(计算、信息与技术学院,慕尼黑技术大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17055 2025-07-24 cs.RO cs.LG 62%

Shared Control of Holonomic Wheelchairs through Reinforcement Learning

Jannis Bähler, Diego Paez-Granados, Jorge Peña-Queralta

机构 * Swiss Paraplegic Research, SPF(瑞士瘫痪研究机构) SCAI Lab, D-HEST, Swiss Federal School of Technology in Zurich - ETH Zurich(SCAI实验室,瑞士联邦理工学院-苏黎世-ETH Zurich) Centre for Artificial Ingelligece, Zurich University of Applied Sciences - ZHAW. Switzerland(人工智能中心,瑞士应用科学大学-ZHAW)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11566 2025-07-17 cs.NE cs.AI cs.RO 62%

Emergent Heterogeneous Swarm Control Through Hebbian Learning

Fuda van Diggelen, Tugay Alperen Karagüzel, Andres Garcia Rincon, A. E. Eiben, Dario Floreano, Eliseo Ferrante

机构 * Computer Science(计算机科学) École Polytechnique Fédérale de Lausanne(瑞士联邦理工学院) New York University Abu Dhabi(纽约大学阿布扎克分校)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09495 2025-07-15 cs.AI cs.ET cs.HC cs.RO cs.SY eess.SY 62%

GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective

Hang Wang, Junshan Zhang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

Comments Position paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08707 2025-07-14 cs.LG cs.RO 62%

SPLASH! Sample-efficient Preference-based inverse reinforcement learning for Long-horizon Adversarial tasks from Suboptimal Hierarchical demonstrations

Peter Crowley, Zachary Serlin, Tyler Paine, Makai Mann, Michael Benjamin, Calin Belta

机构 * Boston University(波士顿大学) MIT Lincoln Laboratory(麻省理工学院林肯实验室) MIT Pavlab(麻省理工学院 Pavlab 实验室) Woods Hole Oceanographic Institution(伍兹霍尔海洋研究所) University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06615 2025-07-10 cs.LG cs.AI 62%

Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance

Jinmin He, Kai Li, Yifan Zang, Haobo Fu, Qiang Fu, Junliang Xing, Jian Cheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Tsinghua University(清华大学) Tencent AI Lab(腾讯AI实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

Comments NeurIPS2024

Journal ref 38th Conference on Neural Information Processing Systems (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13582 2025-07-10 cs.RO cs.LG 62%

Hysteresis-Aware Neural Network Modeling and Whole-Body Reinforcement Learning Control of Soft Robots

Zongyuan Chen, Yan Xia, Jiayuan Liu, Jijia Liu, Wenhao Tang, Jiayu Chen, Feng Gao, Longfei Ma, Hongen Liao, Yu Wang, Chao Yu, Boyu Zhang, Fei Xing

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Updated author affiliation

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04730 2025-07-08 cs.RO cs.LG 62%

CueLearner: Bootstrapping and local policy adaptation from relative feedback

Giulio Schiavi, Andrei Cramariuc, Lionel Ott, Roland Siegwart

机构 * Autonomous Systems Lab, ETH Zurich, Switzerland(自主系统实验室,苏黎世联邦理工学院) Robotics Systems Lab, ETH Zurich, Switzerland(机器人系统实验室,苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments Accepted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03026 2025-07-08 cs.LG cs.AI 62%

Generalized Adaptive Transfer Network: Enhancing Transfer Learning in Reinforcement Learning Across Domains

Abhishek Verma, Nallarasan V, Balaraman Ravindran

机构 * Indian Institute of Technology, Madras, Tamil Nadu, India(印度理工学院马德拉斯分校,塔米尔纳德)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00268 2025-07-02 cs.RO cs.AI cs.SY eess.SY 62%

Control-Optimized Deep Reinforcement Learning for Artificially Intelligent Autonomous Systems

Oren Fivel, Matan Rudman, Kobi Cohen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

Comments 27 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00030 2025-07-02 cs.LG cs.AI 62%

Adaptive Action Duration with Contextual Bandits for Deep Reinforcement Learning in Dynamic Environments

Abhishek Verma, Nallarasan V, Balaraman Ravindran

机构 * Department of Information Technology, SRMIST(SRMIST信息科技系) Indian Institute of Technology, Madras(印度理工学院Madras分校)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21782 2025-06-30 cs.LG cs.RO 62%

M3PO: Massively Multi-Task Model-Based Policy Optimization

Aditya Narendra, Dmitry Makarov, Aleksandr Panov

机构 * Centre for Cognitive Modelling, Moscow Institute of Physics and Technology(认知建模中心,莫斯科物理技术学院) AIRI, the Artificial Intelligence Research Institute(人工智能研究所)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.LG

Comments 6 pages, 4 figures. Accepted at IEEE/RSJ IROS 2025. Full version, including appendix and implementation details

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15799 2025-06-27 cs.RO cs.LG 62%

Steering Your Diffusion Policy with Latent Space Reinforcement Learning

Andrew Wagenmaker, Mitsuhiko Nakamoto, Yunchu Zhang, Seohong Park, Waleed Yagoub, Anusha Nagabandi, Abhishek Gupta, Sergey Levine

机构 * UC Berkeley(伯克利大学) University of Washington(华盛顿大学) Amazon(亚马逊公司)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19469 2025-06-25 cs.CV cs.AI 62%

Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning

Pengfei Hao, Shuaibo Li, Hongqiu Wang, Zhizhuo Kou, Junhang Zhang, Guang Yang, Lei Zhu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学) Department of Thoracic Surgery, the Seventh Affiliated Hospital, Sun Yat-sen University(中山大学第七附属医院胸外科部门) Bioengineering/Imperial-X, Imperial College London(生物工程/Imperial-X,帝国理工学院伦敦分校) ROAS Thrust, Hong Kong University of Science and Technology (Guangzhou)(ROAS项目,香港科技大学(广州)) Department of Electronic and Computer Engineering, Hong Kong SAR(香港特别行政区电子与计算机工程系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18365 2025-06-24 cs.RO cs.AI cs.HC 62%

Robots and Children that Learn Together : Improving Knowledge Retention by Teaching Peer-Like Interactive Robots

Imene Tarakli, Samuele Vinanzi, Richard Moore, Alessandro Di Nuovo

机构 * Department of Computing, Sheffield Hallam University(谢菲尔德哈姆大学计算机系) LOHA Health Ltd(LOHA健康有限公司)

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17263 2025-06-24 cs.LG cs.AI 62%

Memory Allocation in Resource-Constrained Reinforcement Learning

Massimiliano Tamborski, David Abel

机构 * School of Informatics University of Edinburgh(信息学院爱丁堡大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments RLDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12769 2025-06-17 cs.RO cs.LG 62%

RL from Physical Feedback: Aligning Large Motion Models with Humanoid Control

Junpeng Yue, Zepeng Wang, Yuxuan Wang, Weishuai Zeng, Jiangxing Wang, Xinrun Xu, Yu Zhang, Sipeng Zheng, Ziluo Ding, Zongqing Lu

机构 * PKU(北京大学) BeingBeyond WHU(武汉大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05419 2025-06-09 cs.CV cs.AI 62%

Dream to Generalize: Zero-Shot Model-Based Reinforcement Learning for Unseen Visual Distractions

Jeongsoo Ha, Kyungsoo Kim, Yusung Kim

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.CV

Comments AAAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04256 2025-06-09 cs.LG cs.AI 62%

Knowledge Retention for Continual Model-Based Reinforcement Learning

Yixiang Sun, Haotian Fu, Michael Littman, George Konidaris

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03097 2025-06-04 cs.CV cs.AI 62%

EgoVLM: Policy Optimization for Egocentric Video Understanding

Ashwin Vinod, Shrey Pandit, Aditya Vavre, Linshen Liu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.CV

Comments Our Code can be found at https://github.com/adityavavre/VidEgoVLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02746 2025-06-04 cs.RO cs.AI math.OC 62%

Solving the Pod Repositioning Problem with Deep Reinforced Adaptive Large Neighborhood Search

Lin Xie, Hanyi Li

机构 * Brandenburg University of Technology Cottbus-Senftenberg(勃兰登堡技术大学科特博-森芬堡)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 14 pages, 2 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03792 2025-06-04 cs.LG cs.AI 62%

Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning

Lang Feng, Weihao Tan, Zhiyi Lyu, Longtao Zheng, Haiyang Xu, Ming Yan, Fei Huang, Bo An

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21841 2025-06-03 cs.LG cs.AI 62%

An Optimistic Algorithm for online CMDPS with Anytime Adversarial Constraints

Jiahui Zhu, Kihyun Yu, Dabeen Lee, Xin Liu, Honghao Wei

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Proceedings of the 41 st International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20751 2025-06-02 cs.RO cs.AI 62%

Interactive OT Gym: A Reinforcement Learning-Based Interactive Optical tweezer (OT)-Driven Microrobotics Simulation Platform

Zongcai Tan, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X Initiative, Imperial College London(生物工程系、Imperial-X计划、帝国理工学院伦敦)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI

Comments ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19521 2025-06-02 cs.RO cs.LG cs.SY eess.SY 62%

Learning Dynamics under Environmental Constraints via Measurement-Induced Bundle Structures

Dongzhe Zheng, Wenjie Mei

机构 * Dongzhe Zheng Wenjie Mei

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22756 2025-05-30 cs.AI cs.CL cs.LG 62%

Decomposing Elements of Problem Solving: What "Math" Does RL Teach?

Tian Qin, Core Francisco Park, Mujin Kwun, Aaron Walsman, Eran Malach, Nikhil Anand, Hidenori Tanaka, David Alvarez-Melis

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20621 2025-05-28 cs.LG cs.AI 62%

Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning

Shijie Liu, Andrew C. Cullen, Paul Montague, Sarah Erfani, Benjamin I. P. Rubinstein

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院) Defence Science and Technology Group(国防科学与技术集团)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20350 2025-05-28 cs.LG cs.AI 62%

Decision Flow Policy Optimization

Jifeng Hu, Sili Huang, Siyuan Guo, Zhaogeng Liu, Li Shen, Lichao Sun, Hechang Chen, Yi Chang, Dacheng Tao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19867 2025-05-27 cs.LG cs.AI 62%

Deep Active Inference Agents for Delayed and Long-Horizon Environments

Yavar Taheri Yeganeh, Mohsen Jafari, Andrea Matta

机构 * Politecnico di Milano(米兰理工学院) Rutgers University(罗切斯特大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏