arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2105.13806 2021-05-31 cs.RO cs.AI 62%

DRL: Deep Reinforcement Learning for Intelligent Robot Control -- Concept, Literature, and Future

Aras Dargazany

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.05196 2021-05-31 cs.LG cs.AI 62%

A Learning-Based Computational Impact Time Guidance

Zichao Liu, Jiang Wang, Shaoming He, Hyo-Sang Shin, Antonios Tsourdos

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.08710 2021-05-20 cs.LG cs.AI 62%

Fast and Slow Learning of Recurrent Independent Mechanisms

Kanika Madan, Nan Rosemary Ke, Anirudh Goyal, Bernhard Schölkopf, Yoshua Bengio

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICLR'21

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.04699 2021-05-12 cs.LG cs.AI 62%

Adaptive Policy Transfer in Reinforcement Learning

Girish Joshi, Girish Chowdhary

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.04536 2021-05-10 cs.NE cs.AI cs.AR cs.DC cs.LG 62%

Accelerating Deep Neuroevolution on Distributed FPGAs for Reinforcement Learning Problems

Alexis Asseman, Nicolas Antoine, Ahmet S. Ozcan

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments 12 pages. Submitted to ACM Journal on Emerging Technologies in Computing Systems: Special Issue on Hardware and Algorithms for Efficient Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.11419 2021-05-07 cs.LG cs.AI stat.ML 62%

FISAR: Forward Invariant Safe Reinforcement Learning with a Deep Neural Network-Based Optimize

Chuangchuang Sun, Dong-Ki Kim, Jonathan P. How

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICML 2020 Workshop Theoretical Foundations of RL; Accepted to ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.01620 2021-05-06 cs.LG cs.AI 62%

Data-Efficient Reinforcement Learning for Malaria Control

Lixin Zou, Long Xia, Linfang Hou, Xiangyu Zhao, Dawei Yin

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 4 figures, IJCAI 2021 Accepted Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.00153 2021-05-04 cs.RO cs.LG 62%

Pedestrian Collision Avoidance for Autonomous Vehicles at Unsignalized Intersection Using Deep Q-Network

Kasra Mokhtari, Alan R. Wagner

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 8 pages, 8 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.10635 2021-04-30 cs.LG cs.AI cs.MA stat.ML 62%

Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms

Kaiqing Zhang, Zhuoran Yang, Tamer Başar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Invited Chapter in Handbook on RL and Control (Springer Studies in Systems, Decision and Control); Proofread version from the Publisher

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.08492 2021-04-20 cs.AI cs.LG 62%

A Self-Supervised Auxiliary Loss for Deep RL in Partially Observable Settings

Eltayeb Ahmed, Luisa Zintgraf, Christian A. Schroeder de Witt, Nicolas Usunier

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.02921 2021-04-20 cs.RO cs.CV 62%

Unsupervised Visual Attention and Invariance for Reinforcement Learning

Xudong Wang, Long Lian, Stella X. Yu

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.CV

Comments Accepted at CVPR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.05909 2021-04-15 cs.LG cs.RO 62%

Blending MPC & Value Function Approximation for Efficient Reinforcement Learning

Mohak Bhardwaj, Sanjiban Choudhury, Byron Boots

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

Comments 15 pages

Journal ref International Conference on Learning Representations (ICLR), 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08345 2021-04-07 cs.LG cs.RO 62%

Distilling a Hierarchical Policy for Planning and Control via Representation and Reinforcement Learning

Jung-Su Ha, Young-Jin Park, Hyeok-Joo Chae, Soon-Seo Park, Han-Lim Choi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments ICRA 2021, the first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.13267 2021-03-25 cs.RO cs.LG 62%

CLAMGen: Closed-Loop Arm Motion Generation via Multi-view Vision-Based RL

Iretiayo Akinola, Zizhao Wang, Peter Allen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.09756 2021-03-18 cs.LG cs.AI 62%

Near Optimal Policy Optimization via REPS

Aldo Pacchiano, Jonathan Lee, Peter Bartlett, Ofir Nachum

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments 8 main pages, 37 total pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.10762 2021-03-17 cs.LG cs.AI stat.ML 62%

Baconian: A Unified Open-source Framework for Model-Based Reinforcement Learning

Linsen Dong, Guanyu Gao, Xinyi Zhang, Liangyu Chen, Yonggang Wen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.08143 2021-03-16 cs.LG cs.AI stat.ML 62%

Zero-shot Policy Learning with Spatial Temporal RewardDecomposition on Contingency-aware Observation

Huazhe Xu, Boyuan Chen, Yang Gao, Trevor Darrell

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.05079 2021-03-10 cs.LG cs.AI 62%

Domain-Robust Visual Imitation Learning with Mutual Information Constraints

Edoardo Cetin, Oya Celiktutan

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

Comments Presented at ICLR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.14487 2021-03-09 cs.RO cs.AI 62%

Continuous Transition: Improving Sample Efficiency for Continuous Control Problems via MixUp

Junfan Lin, Zhongzhan Huang, Keze Wang, Xiaodan Liang, Weiwei Chen, Liang Lin

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.09324 2021-03-09 cs.LG cs.AI stat.ML 62%

The Sample Complexity of Teaching-by-Reinforcement on Q-Learning

Xuezhou Zhang, Shubham Kumar Bharti, Yuzhe Ma, Adish Singla, Xiaojin Zhu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.01991 2021-03-04 cs.LG cs.AI cs.MA 62%

Adversarial Environment Generation for Learning to Navigate the Web

Izzeddin Gur, Natasha Jaques, Kevin Malta, Manoj Tiwari, Honglak Lee, Aleksandra Faust

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Presented at Deep RL Workshop, NeurIPS, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.10357 2021-02-23 cs.RO cs.LG 62%

How To Train Your HERON

Antoine Richard, Stephanie Aravecchia, Thomas Schillaci, Matthieu Geist, Cedric Pradalier

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.02872 2021-02-12 cs.LG cs.RO stat.ML 62%

Feedback in Imitation Learning: The Three Regimes of Covariate Shift

Jonathan Spencer, Sanjiban Choudhury, Arun Venkatraman, Brian Ziebart, J. Andrew Bagnell

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.02639 2021-02-05 cs.LG cs.AI cs.HC 62%

Improving Reinforcement Learning with Human Assistance: An Argument for Human Subject Studies with HIPPO Gym

Matthew E. Taylor, Nicholas Nissen, Yuan Wang, Neda Navidi

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.06192 2021-02-05 cs.RO cs.LG 62%

Motion Generation Using Bilateral Control-Based Imitation Learning with Autoregressive Learning

Ayumu Sasagawa, Sho Sakaino, Toshiaki Tsuji

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Copyright 2021 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref IEEE Access, Volume 9, Pages 20508-20520, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.11689 2021-01-26 cs.RO cs.AI 62%

Collision Avoidance in Pedestrian-Rich Environments with Deep Reinforcement Learning

Michael Everett, Yu Fan Chen, Jonathan P. How

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments arXiv admin note: substantial text overlap with arXiv:1805.01956

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.02649 2021-01-08 cs.LG cs.RO 62%

CoachNet: An Adversarial Sampling Approach for Reinforcement Learning

Elmira Amirloo Abolfathi, Jun Luo, Peyman Yadmellat, Kasra Rezaee

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments NeurIPS2019 Workshop on Safety and Robustness in Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.01055 2021-01-05 cs.LG cs.RO 62%

Stochastic Action Prediction for Imitation Learning

Sagar Gubbi Venkatesh, Nihesh Rathod, Shishir Kolathaya, Bharadwaj Amrutur

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.01148 2021-01-05 cs.CY cs.AI cs.LG 62%

Applied Machine Learning for Games: A Graduate School Course

Yilei Zeng, Aayush Shah, Jameson Thai, Michael Zyda

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments The Eleventh Symposium on Educational Advances in Artificial Intelligence (EAAI-21)

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.10200 2020-12-21 cs.LG cs.AI cs.SY eess.SY stat.ML 62%

Exact Reduction of Huge Action Spaces in General Reinforcement Learning

Sultan Javed Majeed, Marcus Hutter

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments A variant of this paper was presented at the AAAI-2021 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏