arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2103.04780 2021-09-29 cs.LG cs.AI 62%

A Dual-Memory Architecture for Reinforcement Learning on Neuromorphic Platforms

Wilkie Olin-Ammentorp, Yury Sokolov, Maxim Bazhenov

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08973 2021-09-21 cs.RO cs.AI 62%

Hierarchical Policy for Non-prehensile Multi-object Rearrangement with Deep Reinforcement Learning and Monte Carlo Tree Search

Fan Bai, Fei Meng, Jianbang Liu, Jiankun Wang, Max Q. -H. Meng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05940 2021-09-14 cs.RO cs.LG 62%

Cross Domain Robot Imitation with Invariant Representation

Zhao-Heng Yin, Lingfeng Sun, Hengbo Ma, Masayoshi Tomizuka, Wu-Jun Li

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.09156 2021-09-02 cs.LG cs.RO 62%

Learning Accurate Long-term Dynamics for Model-based Reinforcement Learning

Nathan O. Lambert, Albert Wilcox, Howard Zhang, Kristofer S. J. Pister, Roberto Calandra

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 8 pages, +4 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11623 2021-08-27 cs.LG cs.RO cs.SY eess.SY 62%

Model-based Chance-Constrained Reinforcement Learning via Separated Proportional-Integral Lagrangian

Baiyu Peng, Jingliang Duan, Jianyu Chen, Shengbo Eben Li, Genjin Xie, Congsheng Zhang, Yang Guan, Yao Mu, Enxin Sun

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11510 2021-08-27 cs.CV cs.AI 62%

Deep Reinforcement Learning in Computer Vision: A Comprehensive Survey

Ngan Le, Vidhiwar Singh Rathour, Kashu Yamazaki, Khoa Luu, Marios Savvides

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.04444 2021-08-23 cs.LG cs.AI 62%

Jointly-Learned State-Action Embedding for Efficient Reinforcement Learning

Paul J. Pritz, Liang Ma, Kin K. Leung

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.06526 2021-08-17 cs.LG cs.AI 62%

Fractional Transfer Learning for Deep Model-Based Reinforcement Learning

Remo Sasso, Matthia Sabatelli, Marco A. Wiering

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 8 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.11434 2021-08-17 eess.SY cs.LG cs.RO cs.SY 62%

Graph Neural Network Reinforcement Learning for Autonomous Mobility-on-Demand Systems

Daniele Gammelli, Kaidi Yang, James Harrison, Filipe Rodrigues, Francisco C. Pereira, Marco Pavone

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.08624 2021-08-03 cs.RO cs.AI 62%

Autonomous Drone Racing with Deep Reinforcement Learning

Yunlong Song, Mats Steinweg, Elia Kaufmann, Davide Scaramuzza

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments This paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Prague, 2021. Copyright @ IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.08052 2021-08-03 cs.RO cs.AI 62%

A Learning Approach to Robot-Agnostic Force-Guided High Precision Assembly

Jieliang Luo, Hui Li

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 7 pages, 6 figures; accepted to IROS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.13944 2021-07-30 cs.LG cs.AI stat.ML 62%

Lyapunov-based uncertainty-aware safe reinforcement learning

Ashkan B. Jeddi, Nariman L. Dehghani, Abdollah Shafieezadeh

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Submitted to IEEE Transactions on Neural Networks and Learning Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.11811 2021-07-27 cs.LG cs.AI 62%

Reinforced Imitation Learning by Free Energy Principle

Ryoya Ogishima, Izumi Karino, Yasuo Kuniyoshi

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.02142 2021-07-27 cs.RO cs.LG 62%

Learning to Fly -- a Gym Environment with PyBullet Physics for Reinforcement Learning of Multi-agent Quadcopter Control

Jacopo Panerati, Hehui Zheng, SiQi Zhou, James Xu, Amanda Prorok, Angela P. Schoellig

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 8 pages, 11 figures, accepted for presentation at IROS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00053 2021-07-22 cs.RO cs.AI 62%

LazyDAgger: Reducing Context Switching in Interactive Imitation Learning

Ryan Hoque, Ashwin Balakrishna, Carl Putterman, Michael Luo, Daniel S. Brown, Daniel Seita, Brijen Thananjeyan, Ellen Novoseller, Ken Goldberg

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI

Comments IEEE CASE 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.09359 2021-07-21 cs.LG cs.AI 62%

An Empirical Analysis of Measure-Valued Derivatives for Policy Gradients

João Carvalho, Davide Tateo, Fabio Muratore, Jan Peters

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.08577 2021-07-20 cs.LG cs.AI 62%

Structured World Belief for Reinforcement Learning in POMDP

Gautam Singh, Skand Peri, Junghyun Kim, Hyunseok Kim, Sungjin Ahn

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments Published in ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.08398 2021-07-20 cs.AI cs.LG 62%

Unsupervised Skill-Discovery and Skill-Learning in Minecraft

Juan José Nieto, Roger Creus, Xavier Giro-i-Nieto

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML Unsupervised RL Workshop, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.08241 2021-07-20 cs.LG cs.AI 62%

High-Accuracy Model-Based Reinforcement Learning, a Survey

Aske Plaat, Walter Kosters, Mike Preuss

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:2008.05598

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04538 2021-07-12 cs.RO cs.AI 62%

Learning Interaction-aware Guidance Policies for Motion Planning in Dense Traffic Scenarios

Bruno Brito, Achin Agarwal, Javier Alonso-Mora

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04527 2021-07-12 cs.RO cs.LG 62%

BayesSimIG: Scalable Parameter Inference for Adaptive Domain Randomization with IsaacGym

Rika Antonova, Fabio Ramos, Rafael Possas, Dieter Fox

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.13911 2021-06-29 cs.LG cs.AI 62%

Predictive Control Using Learned State Space Models via Rolling Horizon Evolution

Alvaro Ovalle, Simon M. Lucas

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Accepted at the Bridging the Gap Between AI Planning and Reinforcement Learning (PRL) Workshop at ICAPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.13105 2021-06-25 cs.AI cs.LG 62%

The Option Keyboard: Combining Skills in Reinforcement Learning

André Barreto, Diana Borsa, Shaobo Hou, Gheorghe Comanici, Eser Aygün, Philippe Hamel, Daniel Toyama, Jonathan Hunt, Shibl Mourad, David Silver, Doina Precup

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Published at NeurIPS 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.11365 2021-06-23 cs.RO cs.AI cs.MA 62%

Distributed Heuristic Multi-Agent Path Finding with Communication

Ziyuan Ma, Yudong Luo, Hang Ma

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments Published at ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.07892 2021-06-16 cs.RO cs.AI cs.MA 62%

Towards Safe Control of Continuum Manipulator Using Shielded Multiagent Reinforcement Learning

Guanglin Ji, Junyan Yan, Jingxin Du, Wanquan Yan, Jibiao Chen, Yongkang Lu, Juan Rojas, Shing Shin Cheng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 8 pages, 12 figs, 1 table, 2 pseudo-code

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.14771 2021-06-09 cs.LG cs.AI 62%

Batch Reinforcement Learning with a Nonparametric Off-Policy Policy Gradient

Samuele Tosatto, João Carvalho, Jan Peters

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2001.02435

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.03019 2021-06-08 cs.RO cs.LG 62%

Imitation Learning via Simultaneous Optimization of Policies and Auxiliary Trajectories

Mandy Xie, Anqi Li, Karl Van Wyk, Frank Dellaert, Byron Boots, Nathan Ratliff

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.11448 2021-06-07 cs.LG cs.AI 62%

MUSBO: Model-based Uncertainty Regularized and Sample Efficient Batch Optimization for Deployment Constrained Reinforcement Learning

DiJia Su, Jason D. Lee, John M. Mulvey, H. Vincent Poor

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.10619 2021-06-03 cs.LG cs.AI stat.ML 62%

A Survey of Reinforcement Learning Algorithms for Dynamically Varying Environments

Sindhu Padakandla

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Journal ref ACM Computing Surveys 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.14471 2021-06-01 cs.AI cs.RO 62%

Reducing the Deployment-Time Inference Control Costs of Deep Reinforcement Learning Agents via an Asymmetric Architecture

Chin-Jui Chang, Yu-Wei Chu, Chao-Hsien Ting, Hao-Kang Liu, Zhang-Wei Hong, Chun-Yi Lee

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏