arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2503.15693 2025-03-21 cs.LG 57%

Good Actions Succeed, Bad Actions Generalize: A Case Study on Why RL Generalizes Better

Meng Song

机构 * UC San Diego(加州大学圣地亚哥分校)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15265 2025-03-20 cs.CV 57%

DeepMesh: Auto-Regressive Artist-mesh Creation with Reinforcement Learning

Ruowen Zhao, Junliang Ye, Zhengyi Wang, Guangce Liu, Yiwen Chen, Yikai Wang, Jun Zhu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) ShengShu(升数)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.CV

Comments Project page: https://zhaorw02.github.io/DeepMesh/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03436 2025-03-20 cs.LG 57%

A Role of Environmental Complexity on Representation Learning in Deep Reinforcement Learning Agents

Andrew Liu, Alla Borisyuk

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07933 2025-03-19 cs.LG cs.SY eess.SY math.OC 57%

Offline Hierarchical Reinforcement Learning via Inverse Optimization

Carolin Schmidt, Daniele Gammelli, James Harrison, Marco Pavone, Filipe Rodrigues

机构 * University of YYY(YYY大学) Institute of WWW(WWW研究院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13415 2025-03-18 cs.MA cs.AI 57%

A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives

Weiqiang Jin, Hongyang Du, Biao Zhao, Xingwu Tian, Bohang Shi, Guang Yang

机构 * The University of Hong Kong (HKU)(香港大学) Imperial College London(伦敦帝国学院) National Heart and Lung Institute, Imperial College London(伦敦帝国学院国家心肺研究所) Cardiovascular Research Centre, Royal Brompton Hospital(皇家布朗普顿医院心血管研究中心)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 54 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08338 2025-03-12 cs.RO 57%

Trinity: A Modular Humanoid Robot AI System

Jingkai Sun, Qiang Zhang, Gang Han, Wen Zhao, Zhe Yong, Yan He, Jiaxu Wang, Jiahang Cao, Yijie Guo, Renjing Xu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13683 2025-03-12 cs.RO 57%

PrefMMT: Modeling Human Preferences in Preference-based Reinforcement Learning with Multimodal Transformers

Dezhong Zhao, Ruiqi Wang, Dayoon Suh, Taehyeon Kim, Ziqin Yuan, Byung-Cheol Min, Guohua Chen

机构 * College of Mechanical and Electrical Engineering, Beijing University of Chemical Technology(北京化工大学机电工程学院) Purdue University(普渡大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06580 2025-03-11 cs.AI 57%

Agent models: Internalizing Chain-of-Action Generation into Reasoning models

Yuxiang Zhang, Yuqi Yang, Jiangming Shu, Xinyan Wen, Jitao Sang

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09781 2025-03-06 cs.CV 57%

VideoWorld: Exploring Knowledge Learning from Unlabeled Videos

Zhongwei Ren, Yunchao Wei, Xun Guo, Yao Zhao, Bingyi Kang, Jiashi Feng, Xiaojie Jin

机构 * Beijing Jiaotong University(北京交通大学) ByteDance Seed(字节跳动种子项目)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.CV

Comments Code and models are released at: https://maverickren.github.io/VideoWorld.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02279 2025-03-05 cs.LG 57%

DreamerV3 for Traffic Signal Control: Hyperparameter Tuning and Performance

Qiang Li, Yinhan Lin, Qin Luo, Lina Yu

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18774 2025-03-05 cond-mat.supr-con cs.AI 57%

Self-training superconducting neuromorphic circuits using reinforcement learning rules

M. L. Schneider, E. M. Jué, M. R. Pufall, K. Segall, C. W. Anderson

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments 15 pages, 6 figures

Journal ref npj Unconventional Computing. 2, 5 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01251 2025-03-04 cs.RO 57%

Catching Spinning Table Tennis Balls in Simulation with End-to-End Curriculum Reinforcement Learning

Xiaoyi Hu, Yue Mao, Gang Wang, Qingdu Li, Jianwei Zhang, Yunfeng Ji

机构 * University of Shanghai for Science and Technology(上海理工大学) University of Hamburg(汉堡大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07465 2025-03-04 cs.LG 57%

Offline Reinforcement Learning with Domain-Unlabeled Data

Soichiro Nishimori, Xin-Qiang Cai, Johannes Ackermann, Masashi Sugiyama

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18655 2025-02-27 cs.LG 57%

Provably Efficient RL for Linear MDPs under Instantaneous Safety Constraints in Non-Convex Feature Spaces

Amirhossein Roknilamouki, Arnob Ghosh, Ming Shi, Fatemeh Nourzad, Eylem Ekici, Ness B. Shroff

机构 * The Ohio State University(俄亥俄州立大学) New Jersey Institute of Technology(新泽西理工学院) University at Buffalo(布法罗大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01361 2025-02-25 cs.LG 57%

To the Max: Reinventing Reward in Reinforcement Learning

Grigorii Veviurko, Wendelin Böhmer, Mathijs de Weerdt

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Journal ref Proceedings of the 41st International Conference on Machine Learning, PMLR 235:49455-49470, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06037 2025-02-25 q-fin.TR cs.LG q-fin.GN 57%

Quantitative Trading using Deep Q Learning

Soumyadip Sarkar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14973 2025-02-21 cs.LG math.OC 57%

Efficiently Training Deep-Learning Parametric Policies using Lagrangian Duality

Andrew Rosemberg, Alexandre Street, Davi M. Valladão, Pascal Van Hentenryck

机构 * Georgia Institute of Technology(佐治亚理工学院) Pontifical Catholic University of Rio de Janeiro(里约热内卢天主教大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 8 Main Pages, 8 Appendices, 7 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06394 2025-02-11 cs.LG 57%

PEAR: Primitive Enabled Adaptive Relabeling for Boosting Hierarchical Reinforcement Learning

Utsav Singh, Vinay P. Namboodiri

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04141 2025-02-07 cs.LG 57%

Behavioral Entropy-Guided Dataset Generation for Offline Reinforcement Learning

Wesley A. Suttle, Aamodh Suresh, Carlos Nieto-Granda

机构 * U.S. Army Research Laboratory(美国陆军研究实验室)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17424 2025-02-06 cs.CV 57%

LARM: Large Auto-Regressive Model for Long-Horizon Embodied Intelligence

Zhuoling Li, Xiaogang Xu, Zhenhua Xu, SerNam Lim, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) University of Central Florida(中佛罗里达大学)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01616 2025-02-04 cs.LG 57%

Preference VLM: Leveraging VLMs for Scalable Preference-Based Reinforcement Learning

Udita Ghosh, Dripta S. Raychaudhuri, Jiachen Li, Konstantinos Karydis, Amit Roy-Chowdhury

机构 * University of California, Riverside(加州大学河滨分校) AWS AI Labs(AWS AI实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01465 2025-02-04 cs.RO cs.SY eess.SY 57%

Embrace Collisions: Humanoid Shadowing for Deployable Contact-Agnostics Motions

Ziwen Zhuang, Hang Zhao

机构 * IIIS, Tsinghua University(清华大学信息科学技术学院) Shanghai Qi Zhi Institute(上海期智研究院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00726 2025-02-04 cs.AI 57%

Perspectives for Direct Interpretability in Multi-Agent Deep Reinforcement Learning

Yoann Poupart, Aurélie Beynier, Nicolas Maudet

机构 * LIP6, Sorbonne University(巴黎第六大学(索邦大学)LIP6实验室)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16590 2025-01-29 cs.RO cs.SY eess.SY 57%

Benchmarking Model Predictive Control and Reinforcement Learning Based Control for Legged Robot Locomotion in MuJoCo Simulation

Shivayogi Akki, Tan Chen

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12150 2025-01-22 cs.CV 57%

DNRSelect: Active Best View Selection for Deferred Neural Rendering

Dongli Wu, Haochen Li, Xiaobao Wei

机构 * College of Design and Engineering, National University of Singapore(新加坡国立大学设计与工程学院) School of Cyber Science and Technology, Beihang University(北京航空航天大学网络空间科学与技术学院) University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.CV

Comments 7 pages, 8 figures, submitted to ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17906 2025-01-22 cs.RO 57%

VIEW: Visual Imitation Learning with Waypoints

Ananth Jonnavittula, Sagar Parekh, Dylan P. Losey

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments 27 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06328 2025-01-22 cs.LG 57%

Distributional Successor Features Enable Zero-Shot Policy Optimization

Chuning Zhu, Xinqi Wang, Tyler Han, Simon S. Du, Abhishek Gupta

机构 * University of Washington(华盛顿大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.01707 2025-01-07 stat.ML cs.LG 57%

Testing Stationarity and Change Point Detection in Reinforcement Learning

Mengbing Li, Chengchun Shi, Zhenke Wu, Piotr Fryzlewicz

机构 * University of Michigan(密歇根大学) London School of Economics and Political Science(伦敦政治经济学院)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.13091 2025-01-07 cs.LG 57%

Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search

Yonggan Fu, Zhongzhi Yu, Yongan Zhang, Yingyan Celine Lin

机构 * Rice University(莱斯大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23242 2025-01-06 cs.AI 57%

A little less conversation, a little more action, please: Investigating the physical common-sense of LLMs in a 3D embodied environment

Matteo G. Mecattaf, Ben Slater, Marko Tešić, Jonathan Prunty, Konstantinos Voudouris, Lucy G. Cheke

机构 * University of Cambridge(剑桥大学) Institute for Human Centered AI(以人为本人工智能研究所) Helmholtz Zentrum(亥姆霍兹中心)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.AI

Comments 25 pages, 4 figures; v2: Added AFMR Acknowledgment

详情

展开后加载摘要…

URL PDF HTML 收藏