arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

1810.11748 2018-10-30 cs.HC cs.LG 57%

DQN-TAMER: Human-in-the-Loop Reinforcement Learning with Intractable Feedback

Riku Arakawa, Sosuke Kobayashi, Yuya Unno, Yuta Tsuboi, Shin-ichi Maeda

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.06339 2018-10-16 cs.LG stat.ML 57%

Deep Reinforcement Learning

Yuxi Li

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Under review for Morgan & Claypool: Synthesis Lectures in Artificial Intelligence and Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.01531 2018-10-09 cs.RO 57%

A Practical Approach to Insertion with Variable Socket Position Using Deep Reinforcement Learning

Mel Vecerik, Oleg Sushkov, David Barker, Thomas Rothörl, Todd Hester, Jon Scholz

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.00468 2018-10-02 cs.LG stat.ML 57%

Bayesian Transfer Reinforcement Learning with Prior Knowledge Rules

Michalis K. Titsias, Sotirios Nikoloutsopoulos

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.05872 2018-09-18 cs.LG stat.ML 57%

Inspiration Learning through Preferences

Nir Baram, Shie Mannor

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.05819 2018-09-18 cs.RO 57%

Deep Learning with Experience Ranking Convolutional Neural Network for Robot Manipulator

Hai Nguyen, Hung Manh La, Matthew Deans

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.10728 2018-09-18 cs.LG stat.ML 57%

Deep PDF: Probabilistic Surface Optimization and Density Estimation

Dmitry Kopitkov, Vadim Indelman

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.03548 2018-09-17 cs.LG stat.ML 57%

VPE: Variational Policy Embedding for Transfer Reinforcement Learning

Isac Arnekvist, Danica Kragic, Johannes A. Stork

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.01164 2018-09-13 cs.CV 57%

The History Began from AlexNet: A Comprehensive Survey on Deep Learning Approaches

Md Zahangir Alom, Tarek M. Taha, Christopher Yakopcic, Stefan Westberg, Paheding Sidike, Mst Shamima Nasrin, Brian C Van Esesn, Abdul A S. Awwal, Vijayan K. Asari

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

Comments 39 pages, 46 figures, 3 tables. arXiv admin note: text overlap with arXiv:1408.3264, arXiv:1411.4046

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.00510 2018-09-11 cs.LG stat.ML 57%

Flatland: a Lightweight First-Person 2-D Environment for Reinforcement Learning

Hugo Caselles-Dupré, Louis Annabi, Oksana Hagen, Michael Garcia-Ortiz, David Filliat

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Accepted to the Workshop on Continual Unsupervised Sensorimotor Learning (ICDL-EpiRob 2018)

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.03931 2018-08-02 cs.LG stat.ML 57%

A Hierarchical Bayesian Linear Regression Model with Local Features for Stochastic Dynamics Approximation

Behnoosh Parsa, Keshav Rajasekaran, Franziska Meier, Ashis G. Banerjee

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 38 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.07551 2018-07-10 stat.ML cs.LG 57%

Meta Reinforcement Learning with Latent Variable Gaussian Processes

Steindór Sæmundsson, Katja Hofmann, Marc Peter Deisenroth

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.01830 2018-06-29 cs.LG stat.ML 57%

Relational Deep Reinforcement Learning

Vinicius Zambaldi, David Raposo, Adam Santoro, Victor Bapst, Yujia Li, Igor Babuschkin, Karl Tuyls, David Reichert, Timothy Lillicrap, Edward Lockhart, Murray Shanahan, Victoria Langston, Razvan Pascanu, Matthew Botvinick, Oriol Vinyals, Peter Battaglia

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.05554 2018-06-15 cs.AI 57%

Adaptive Shooting for Bots in First Person Shooter Games Using Reinforcement Learning

Frank G. Glavin, Michael G. Madden

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments IEEE Transactions on Computational Intelligence and AI in Games (2015)

Journal ref Glavin, Frank G., and Michael G. Madden. "Adaptive shooting for bots in first person shooter games using reinforcement learning." IEEE Transactions on Computational Intelligence and AI in Games 7, no. 2: 180-192. (2015)

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.06374 2018-05-22 cs.CV 57%

Fast Retinomorphic Event Stream for Video Recognition and Reinforcement Learning

Wanjia Liu, Huaijin Chen, Rishab Goel, Yuzhong Huang, Ashok Veeraraghavan, Ankit Patel

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.04969 2018-05-15 cs.CV 57%

Learning Temporal Strategic Relationships using Generative Adversarial Imitation Learning

Tharindu Fernando, Simon Denman, Sridha Sridharan, Clinton Fookes

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

Comments International Foundation for Autonomous Agents and Multiagent Systems, 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.02632 2018-05-14 cs.AI cs.CL 57%

Extracting Action Sequences from Texts Based on Deep Reinforcement Learning

Wenfeng Feng, Hankz Hankui Zhuo, Subbarao Kambhampati

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 7pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.06034 2018-03-30 cs.LG stat.ML 57%

Stochastic Variance Reduction for Policy Gradient Estimation

Tianbing Xu, Qiang Liu, Jian Peng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.10467 2018-02-01 cs.AI cs.PL cs.SE 57%

Deep Reinforcement Learning for Programming Language Correction

Rahul Gupta, Aditya Kanade, Shirish Shevade

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.09344 2017-12-29 cs.AI 57%

Whatever Does Not Kill Deep Reinforcement Learning, Makes It Stronger

Vahid Behzadan, Arslan Munir

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

Comments arXiv admin note: text overlap with arXiv:1701.04143

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.07887 2017-12-22 cs.MA cs.AI 57%

Multiagent-based Participatory Urban Simulation through Inverse Reinforcement Learning

Soma Suzuki

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.10173 2017-12-01 cs.LG stat.ML 57%

Hierarchical Policy Search via Return-Weighted Density Estimation

Takayuki Osa, Masashi Sugiyama

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments The 32nd AAAI Conference on Artificial Intelligence (AAAI 2018), 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.07597 2017-09-25 cs.AI 57%

Inverse Reinforcement Learning with Conditional Choice Probabilities

Mohit Sharma, Kris M. Kitani, Joachim Groeger

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.06347 2017-08-29 cs.LG 57%

Proximal Policy Optimization Algorithms

John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, Oleg Klimov

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.04818 2017-07-18 cs.CV 57%

RED: Reinforced Encoder-Decoder Networks for Action Anticipation

Jiyang Gao, Zhenheng Yang, Ram Nevatia

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.01077 2017-06-06 cs.AI 57%

Actor-Critic for Linearly-Solvable Continuous MDP with Partially Known Dynamics

Tomoki Nishi, Prashant Doshi, Michael R. James, Danil Prokhorov

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.02239 2017-05-17 cs.AI 57%

Functions that Emerge through End-to-End Reinforcement Learning - The Direction for Artificial General Intelligence -

Katsunari Shibata

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.AI

Comments The Multi-disciplinary Conference on Reinforcement Learning and Decision Making (RLDM) 2017, 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1502.05477 2017-04-24 cs.LG 57%

Trust Region Policy Optimization

John Schulman, Sergey Levine, Philipp Moritz, Michael I. Jordan, Pieter Abbeel

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 16 pages, ICML 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.01030 2017-03-06 cs.LG 57%

Deeply AggreVaTeD: Differentiable Imitation Learning for Sequential Prediction

Wen Sun, Arun Venkatraman, Geoffrey J. Gordon, Byron Boots, J. Andrew Bagnell

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1610.01986 2016-10-07 cs.LG 57%

Active exploration in parameterized reinforcement learning

Mehdi Khamassi, Costas Tzafestas

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Submitted to EWRL2016

详情

展开后加载摘要…

URL PDF HTML 收藏