arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2107.06106 2021-10-28 cs.LG 57%

Conservative Offline Distributional Reinforcement Learning

Yecheng Jason Ma, Dinesh Jayaraman, Osbert Bastani

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.08918 2021-10-26 cs.LG cs.NE cs.SY eess.SY 57%

Towards Automatic Actor-Critic Solutions to Continuous Control

Jake Grigsby, Jin Yong Yoo, Yanjun Qi

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments NeurIPS Deep RL Workshop 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.16244 2021-10-26 cs.AI 57%

Interleaving Fast and Slow Decision Making

Aditya Gulati, Sarthak Soni, Shrisha Rao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments 7 pages, 11 figures; typos corrected, references added

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.00163 2021-10-26 cs.LG stat.ML 57%

Bayesian Meta-reinforcement Learning for Traffic Signal Control

Yayi Zou, Zhiwei Qin

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.07395 2021-10-15 cs.LG 57%

Offline Reinforcement Learning with Soft Behavior Regularization

Haoran Xu, Xianyuan Zhan, Jianxiong Li, Honglei Yin

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.08562 2021-10-12 cs.LG stat.ML 57%

Sample Complexity of Estimating the Policy Gradient for Nearly Deterministic Dynamical Systems

Osbert Bastani

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.04649 2021-10-12 cs.AI 57%

Interactive Hierarchical Guidance using Language

Bharat Prakash, Nicholas Waytowich, Tim Oates, Tinoosh Mohsenin

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments Presented at AI-HRI symposium as part of AAAI-FSS 2021 (arXiv:2109.10836)

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.01926 2021-10-06 cs.RO 57%

Improved Reinforcement Learning Coordinated Control of a Mobile Manipulator using Joint Clamping

Denis Hadjivelichkov, Kostas Vlachos, Dimitrios Kanoulas

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 6 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.13851 2021-09-29 cs.LG q-fin.CP 57%

Reinforcement Learning for Quantitative Trading

Shuo Sun, Rundong Wang, Bo An

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.13377 2021-09-29 eess.SY cs.AI cs.FL cs.SY 57%

Model-Free Reinforcement Learning for Optimal Control of MarkovDecision Processes Under Signal Temporal Logic Specifications

Krishna C. Kalagarla, Rahul Jain, Pierluigi Nuzzo

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments Accepted for CDC 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.09650 2021-09-29 cs.RO 57%

Learning to Share Autonomy Across Repeated Interaction

Ananth Jonnavittula, Dylan P. Losey

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.10719 2021-09-28 cs.RO cs.SY eess.SY 57%

Autonomous Blimp Control using Deep Reinforcement Learning

Yu Tang Liu, Eric Price, Pascal Goldschmid, Michael J. Black, Aamir Ahmad

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.10460 2021-09-23 cs.RO 57%

Graph-based Cluttered Scene Generation and Interactive Exploration using Deep Reinforcement Learning

K. Niranjan Kumar, Irfan Essa, Sehoon Ha

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08231 2021-09-20 cs.LG 57%

RAPID-RL: A Reconfigurable Architecture with Preemptive-Exits for Efficient Deep-Reinforcement Learning

Adarsh Kumar Kosta, Malik Aqeel Anwar, Priyadarshini Panda, Arijit Raychowdhury, Kaushik Roy

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.12919 2021-09-17 cs.AI 57%

First return, then explore

Adrien Ecoffet, Joost Huizinga, Joel Lehman, Kenneth O. Stanley, Jeff Clune

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments 47 pages, 14 figures, 4 tables; reorganized sections and modified SI text extensively; added reference to the published version, changed title to published title; added reference to published unformatted pdf

Journal ref Nature 590, 580-586 (2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.03186 2021-09-15 cs.RO stat.ML 57%

Learning Time-Invariant Reward Functions through Model-Based Inverse Reinforcement Learning

Todor Davchev, Sarah Bechtle, Subramanian Ramamoorthy, Franziska Meier

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05872 2021-08-13 cs.AI 57%

HAC Explore: Accelerating Exploration with Hierarchical Reinforcement Learning

Willie McClinton, Andrew Levy, George Konidaris

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.13861 2021-08-05 cs.DB cs.LG 57%

Auto-Pipeline: Synthesizing Complex Data Pipelines By-Target Using Reinforcement Learning and Search

Junwen Yang, Yeye He, Surajit Chaudhuri

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments This is a full version of a conference paper to appear at VLDB 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.01593 2021-08-04 cs.HC cs.RO 57%

SwarmPlay: Interactive Tic-tac-toe Board Game with Swarm of Nano-UAVs driven by Reinforcement Learning

Ekaterina Karmanova, Valerii Serpiva, Stepan Perminov, Aleksey Fedoseev, Dzmitry Tsetserukou

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments Accepted to the 30th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN). 2021. IEEE copyright. arXiv admin note: substantial text overlap with arXiv:2108.00488

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.00625 2021-08-03 cs.LG 57%

Adaptive t-Momentum-based Optimization for Unknown Ratio of Outliers in Amateur Data in Imitation Learning

Wendyam Eric Lionel Ilboudo, Taisuke Kobayashi, Kenji Sugimoto

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments 7 pages, Accepted in IROS 2021, See video pitch with main result on https://youtu.be/FfW_moT1-wU

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04989 2021-07-13 cs.RO cs.SY eess.SY 57%

Stabilizing Neural Control Using Self-Learned Almost Lyapunov Critics

Ya-Chien Chang, Sicun Gao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.03600 2021-07-09 cs.RO cs.SY eess.SY 57%

Reinforcement Learning based Negotiation-aware Motion Planning of Autonomous Vehicles

Zhitao Wang, Yuzheng Zhuang, Qiang Gu, Dong Chen, Hongbo Zhang, Wulong Liu

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.06326 2021-07-06 cs.LG 57%

S4RL: Surprisingly Simple Self-Supervision for Offline Reinforcement Learning

Samarth Sinha, Ajay Mandlekar, Animesh Garg

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.14338 2021-06-29 cs.LG stat.ML 57%

Regret Analysis in Deterministic Reinforcement Learning

Damianos Tranos, Alexandre Proutiere

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.13798 2021-06-25 cs.LG 57%

Improving Playtesting Coverage via Curiosity Driven Reinforcement Learning Agents

Camilo Gordillo, Joakim Bergdahl, Konrad Tollmar, Linus Gisslén

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.06431 2021-06-14 cs.LG 57%

Offline Reinforcement Learning as Anti-Exploration

Shideh Rezaeifar, Robert Dadashi, Nino Vieillard, Léonard Hussenot, Olivier Bachem, Olivier Pietquin, Matthieu Geist

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.05402 2021-06-11 cs.LG 57%

Deception in Social Learning: A Multi-Agent Reinforcement Learning Perspective

Paul Chelarescu

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.01948 2021-06-03 cs.LG 57%

Offline Reinforcement Learning with Pseudometric Learning

Robert Dadashi, Shideh Rezaeifar, Nino Vieillard, Léonard Hussenot, Olivier Pietquin, Matthieu Geist

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.06005 2021-06-01 cs.RO 57%

SimGAN: Hybrid Simulator Identification for Domain Adaptation via Adversarial Reinforcement Learning

Yifeng Jiang, Tingnan Zhang, Daniel Ho, Yunfei Bai, C. Karen Liu, Sergey Levine, Jie Tan

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments ICRA 2021, Code Available at: https://github.com/jyf588/SimGAN ; Accompanying Video: https://youtu.be/McKOGllO7nc

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.04986 2021-05-12 cs.SE cs.RO 57%

A Meta Reinforcement Learning-based Approach for Self-Adaptive System

Mingyue Zhang, Jialong Li, Haiyan Zhao, Kenji Tei, Shinichi Honiden, Zhi Jin

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 11 pages, 2nd IEEE International Conference on Autonomic Computing and Self-Organizing Systems - ACSOS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏