arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

1906.08383 2020-06-30 math.OC cs.LG cs.SY eess.SY math.ST stat.TH 57%

Global Convergence of Policy Gradient Methods to (Almost) Locally Optimal Policies

Kaiqing Zhang, Alec Koppel, Hao Zhu, Tamer Başar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Initially submitted in Jan. 2019. Accepted to SIAM Journal on Control and Optimization (SICON)

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.03499 2020-06-29 cs.LG stat.ML 57%

Online Constrained Model-based Reinforcement Learning

Benjamin van Niekerk, Andreas Damianou, Benjamin Rosman

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Conf. Uncertainty in Artificial Intelligence (UAI). 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.10810 2020-06-22 cs.LG stat.ML 57%

Reparameterized Variational Divergence Minimization for Stable Imitation

Dilip Arumugam, Debadeepta Dey, Alekh Agarwal, Asli Celikyilmaz, Elnaz Nouri, Bill Dolan

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.07815 2020-06-16 cs.LG math.OC stat.ML 57%

Optimistic Distributionally Robust Policy Optimization

Jun Song, Chaoyue Zhao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.07777 2020-06-16 cs.LG cs.HC stat.ML 57%

Active Imitation Learning from Multiple Non-Deterministic Teachers: Formulation, Challenges, and Algorithms

Khanh Nguyen, Hal Daumé

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.07041 2020-06-15 stat.ML cs.LG 57%

Mutual Information Based Knowledge Transfer Under State-Action Dimension Mismatch

Michael Wan, Tanmay Gangwani, Jian Peng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Conference on Uncertainty in Artificial Intelligence (UAI 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.09725 2020-06-11 cs.AI 57%

Conservative Agency via Attainable Utility Preservation

Alexander Matt Turner, Dylan Hadfield-Menell, Prasad Tadepalli

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments Published in AI, Ethics, and Society 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.10570 2020-06-08 cs.SI cs.LG 57%

Detecting Troll Behavior via Inverse Reinforcement Learning: A Case Study of Russian Trolls in the 2016 US Election

Luca Luceri, Silvia Giordano, Emilio Ferrara

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.08786 2020-05-26 cs.LG stat.ML 57%

Maximum Entropy-Regularized Multi-Goal Reinforcement Learning

Rui Zhao, Xudong Sun, Volker Tresp

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Published in International Conference on Machine Learning (ICML 2019), Long Beach, USA. arXiv admin note: text overlap with arXiv:1902.08039

Journal ref PMLR 97:7553-7562, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.00981 2020-05-19 cs.AI 57%

Benchmarking End-to-End Behavioural Cloning on Video Games

Anssi Kanervisto, Joonas Pussinen, Ville Hautamäki

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments To appear in IEEE Conference on Games 2020. Experiment code available at https://github.com/joonaspu/video-game-behavioural-cloning and https://github.com/joonaspu/ViControl

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.00935 2020-05-05 cs.LG cs.MA cs.SY eess.SP eess.SY stat.ML 57%

Deep Reinforcement Learning for Intelligent Transportation Systems: A Survey

Ammar Haydari, Yasin Yilmaz

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.12909 2020-05-01 cs.LG stat.ML 57%

Evolutionary Stochastic Policy Distillation

Hao Sun, Xinyu Pan, Bo Dai, Dahua Lin, Bolei Zhou

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.02380 2020-04-07 cs.LG stat.ML 57%

Intrinsic Exploration as Multi-Objective RL

Philippe Morere, Fabio Ramos

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.10026 2020-03-24 cs.NE cs.RO cs.SY eess.SY 57%

Learning to Walk: Spike Based Reinforcement Learning for Hexapod Robot Central Pattern Generation

Ashwin Sanjay Lele, Yan Fang, Justin Ting, Arijit Raychowdhury

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 5 pages, 7 figures, to be published in proceeding of IEEE AICAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.05325 2020-03-12 cs.LG stat.ML 57%

Meta-learning curiosity algorithms

Ferran Alet, Martin F. Schneider, Tomas Lozano-Perez, Leslie Pack Kaelbling

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Published in ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.06489 2020-03-10 cs.RO 57%

Multi-Fidelity Reinforcement Learning with Gaussian Processes

Varun Suryan, Nahush Gondhalekar, Pratap Tokekar

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.00179 2020-03-04 cs.LG stat.ML 57%

TAdam: A Robust Stochastic Gradient Optimizer

Wendyam Eric Lionel Ilboudo, Taisuke Kobayashi, Kenji Sugimoto

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.01074 2020-03-03 cs.LG stat.ML 57%

Gaussian Process Policy Optimization

Ashish Rao, Bidipta Sarkar, Tejas Narayanan

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.05396 2020-02-18 cs.LG stat.ML 57%

Network Randomization: A Simple Technique for Generalization in Deep Reinforcement Learning

Kimin Lee, Kibok Lee, Jinwoo Shin, Honglak Lee

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Accepted in ICLR 2020 and NeurIPS Workshop on Deep RL 2019 / First two authors are equally contributed

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.02693 2020-02-10 cs.LG stat.ML 57%

Ready Policy One: World Building Through Active Learning

Philip Ball, Jack Parker-Holder, Aldo Pacchiano, Krzysztof Choromanski, Stephen Roberts

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.06272 2020-02-06 cs.RO 57%

Contact Skill Imitation Learning for Robot-Independent Assembly Programming

Stefan Scherzinger, Arne Roennau, Rüdiger Dillmann

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 8 pages, 12 figures, presented at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.00934 2020-01-31 cs.LG cs.IT cs.SY eess.SY math.IT math.OC stat.ML 57%

Finite-Sample Analysis of Decentralized Temporal-Difference Learning with Linear Function Approximation

Jun Sun, Gang Wang, Georgios B. Giannakis, Qinmin Yang, Zaiyue Yang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 25 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.05188 2020-01-28 cs.LG cs.MA stat.ML 57%

CM3: Cooperative Multi-goal Multi-stage Multi-agent Reinforcement Learning

Jiachen Yang, Alireza Nakhaei, David Isele, Kikuo Fujimura, Hongyuan Zha

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Published at International Conference on Learning Representations 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.06781 2020-01-22 cs.AI 57%

FRESH: Interactive Reward Shaping in High-Dimensional State Spaces using Human Feedback

Baicen Xiao, Qifan Lu, Bhaskar Ramasubramanian, Andrew Clark, Linda Bushnell, Radha Poovendran

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments Accepted as Full Paper to International Conference on Autonomous Agents and Multi-Agent Systems (AAMAS) 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.02652 2020-01-09 cs.LG stat.ML 57%

Sample-based Distributional Policy Gradient

Rahul Singh, Keuntaek Lee, Yongxin Chen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.00048 2020-01-03 cs.RO 57%

MIR-Vehicle: Cost-Effective Research Platform for Autonomous Vehicle Applications

Ahmed Abdelhamed, Balakrishna Yadav Peddagolla, Girma Tewolde, Jaerock Kwon

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.10703 2019-12-25 cs.LG cs.NE cs.SY eess.SY stat.ML 57%

Variational Recurrent Models for Solving Partially Observable Control Tasks

Dongqi Han, Kenji Doya, Jun Tani

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Published as a conference paper at the Eighth International Conference on Learning Representations (ICLR 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.05128 2019-12-12 cs.LG stat.ML 57%

Marginalized State Distribution Entropy Regularization in Policy Optimization

Riashat Islam, Zafarali Ahmed, Doina Precup

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments In Submission; Appeared at NeurIPS 2019 Deep Reinforcement Learning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.03193 2019-12-09 cs.LG math.OC stat.ML 57%

Risk-Averse Trust Region Optimization for Reward-Volatility Reduction

Lorenzo Bisi, Luca Sabbioni, Edoardo Vittori, Matteo Papini, Marcello Restelli

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.02552 2019-12-06 cs.AI 57%

Reinforcement Learning with Non-Markovian Rewards

Maor Gaon, Ronen I. Brafman

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

Comments To Appear in AAAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏