arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2203.09637 2022-03-21 cs.LG 57%

Investigating Compounding Prediction Errors in Learned Dynamics Models

Nathan Lambert, Kristofer Pister, Roberto Calandra

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 25 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08389 2022-03-16 cs.RO cs.SY eess.SY 57%

Analysis of Model-Free Reinforcement Learning Control Schemes on self-balancing Wheeled Extendible System

Kanishk ., Rushil Kumar, Vikas Rastogi, Ajeet Kumar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05360 2022-03-11 cs.RO cs.SY eess.SY 57%

Deep Residual Reinforcement Learning based Autonomous Blimp Control

Yu Tang Liu, Eric Price, Michael J. Black, Aamir Ahmad

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.03917 2022-03-09 cs.LG 57%

An Analysis of Measure-Valued Derivatives for Policy Gradients

Joao Carvalho, Jan Peters

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05120 2022-03-07 cs.RO 57%

TERP: Reliable Planning in Uneven Outdoor Environments using Deep Reinforcement Learning

Kasun Weerakoon, Adarsh Jagan Sathyamoorthy, Utsav Patel, Dinesh Manocha

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.10915 2022-03-01 cs.LG cs.MA 57%

Multi-Agent Reinforcement Learning for Markov Routing Games: A New Modeling Paradigm For Dynamic Traffic Assignment

Zhenyu Shou, Xu Chen, Yongjie Fu, Xuan Di

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 20 pages, 11 figures, published in Transportation Research Part C 137 (2022) 103560

Journal ref Transportation Research Part C: Emerging Technologies 137, 103560 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12260 2022-02-25 cs.AI 57%

Self-organising Urban Traffic control on micro-level using Reinforcement Learning and Agent-based Modelling

Stefan Bosse

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.06003 2022-02-16 cs.LG 57%

Robust Learning from Observation with Model Misspecification

Luca Viano, Yu-Ting Huang, Parameswaran Kamalaruban, Craig Innes, Subramanian Ramamoorthy, Adrian Weller

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments accepted to AAMAS 2022 (camera-ready version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.06466 2022-02-16 cs.RO 57%

Imitation learning for variable speed motion generation over multiple actions

Yuki Saigusa, Ayumu Sasagawa, Sho Sakaino, Toshiaki Tsuji

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments Copyright 2021 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref IECON 2021 47th Annual Conference of the IEEE Industrial Electronics Society, Oct. 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04836 2022-02-15 cs.LG math.DS physics.data-an stat.ML 57%

Deconstructing the Inductive Biases of Hamiltonian Neural Networks

Nate Gruver, Marc Finzi, Samuel Stanton, Andrew Gordon Wilson

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments ICLR 2022. Code available at https://github.com/ngruver/decon-hnn

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.06496 2022-02-03 cs.LG cs.CR stat.ML 57%

Certifiable Robustness to Adversarial State Uncertainty in Deep Reinforcement Learning

Michael Everett, Bjorn Lutjens, Jonathan P. How

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:1910.12908

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.01993 2022-01-21 cs.RO 57%

A Survey of Deep RL and IL for Autonomous Driving Policy Learning

Zeyu Zhu, Huijing Zhao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.11015 2022-01-20 cs.IT cs.LG eess.SP math.IT 57%

Trajectory Design for UAV-Based Internet-of-Things Data Collection: A Deep Reinforcement Learning Approach

Yang Wang, Zhen Gao, Jun Zhang, Xianbin Cao, Dezhi Zheng, Yue Gao, Derrick Wing Kwan Ng, Marco Di Renzo

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Accepted by IEEE Internet of Things Journal. The codes and some other materials about this work may be available at https://gaozhen16.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.13524 2022-01-19 cs.LG 57%

Improving Generalization in Meta-RL with Imaginary Tasks from Latent Dynamics Mixture

Suyoung Lee, Sae-Young Chung

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.05753 2022-01-19 cs.RO 57%

Parameter Identification and Motion Control for Articulated Rigid Body Robots Using Differentiable Position-based Dynamics

Fei Liu, Mingen Li, Jingpei Lu, Entong Su, Michael C. Yip

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 15pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.15092 2022-01-19 cs.LG 57%

A Law of Iterated Logarithm for Multi-Agent Reinforcement Learning

Gugan Thoppe, Bhumesh Kumar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Some typos corrected; 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.09101 2022-01-14 eess.SY cs.LG cs.SY math.OC 57%

Safe Policies for Reinforcement Learning via Primal-Dual Methods

Santiago Paternain, Miguel Calvo-Fullana, Luiz F. O. Chamon, Alejandro Ribeiro

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:1910.13393

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.12020 2022-01-04 cs.LG stat.ML 57%

Improving Actor-Critic Reinforcement Learning via Hamiltonian Monte Carlo Method

Duo Xu, Faramarz Fekri

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.01101 2021-12-24 cs.LG cs.SY eess.SY 57%

Parallel Actors and Learners: A Framework for Generating Scalable RL Implementations

Chi Zhang, Sanmukh Rao Kuppannagari, Viktor K Prasanna

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 10 pages. HiPC21

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.05218 2021-12-13 cs.AI 57%

Learning Generalizable Behavior via Visual Rewrite Rules

Yiheng Xie, Mingxuan Li, Shangqun Yu, Michael Littman

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

Comments AAAI 2022 Workshop on Reinforcement Learning in Games

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.02694 2021-12-07 cs.LG 57%

Benchmark for Out-of-Distribution Detection in Deep Reinforcement Learning

Aaqib Parvez Mohammed, Matias Valdenegro-Toro

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 9 pages, 5 figures, 5 tables, Bayesian Deep Learning Workshop @ NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.11743 2021-11-24 cs.GT cs.LG math.DS 57%

Independent Learning in Stochastic Games

Asuman Ozdaglar, Muhammed O. Sayin, Kaiqing Zhang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments An invited chapter for the International Congress of Mathematicians 2022 (ICM 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.09688 2021-11-16 cs.LG cs.NE cs.SY eess.SY stat.ML 57%

Symbolic Regression Methods for Reinforcement Learning

Jiří Kubalík, Erik Derner, Jan Žegklitz, Robert Babuška

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Journal ref in IEEE Access, vol. 9, pp. 139697-139711, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.03380 2021-11-15 cs.RO 57%

RRL: Resnet as representation for Reinforcement Learning

Rutav Shah, Vikash Kumar

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments Published at ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.06017 2021-11-12 cs.RO 57%

Yaw-Guided Imitation Learning for Autonomous Driving in Urban Environments

Yandong Liu, Chengzhong Xu, Hui Kong

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments 9 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.02805 2021-11-08 math.OC cs.LG cs.MA 57%

Fast Multi-Agent Temporal-Difference Learning via Homotopy Stochastic Primal-Dual Optimization

Dongsheng Ding, Xiaohan Wei, Zhuoran Yang, Zhaoran Wang, Mihailo R. Jovanović

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 29 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.15172 2021-10-29 cs.LG stat.ML 57%

Conditioning Sparse Variational Gaussian Processes for Online Decision-making

Wesley J. Maddox, Samuel Stanton, Andrew Gordon Wilson

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.14770 2021-10-29 cs.LG 57%

TRAIL: Near-Optimal Imitation Learning with Suboptimal Data

Mengjiao Yang, Sergey Levine, Ofir Nachum

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.13345 2021-10-29 cs.LG 57%

Adversarial Intrinsic Motivation for Reinforcement Learning

Ishan Durugkar, Mauricio Tec, Scott Niekum, Peter Stone

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.02145 2021-10-28 cs.LG 57%

Temporal Shift Reinforcement Learning

Deepak George Thomas, Tichakorn Wongpiromsarn, Ali Jannesari

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏