Optimal Control of Probabilistic Dynamics Models via Mean Hamiltonian Minimization
David Leeftink, Çağatay Yıldız, Steffen Ridderbusch, Max Hinne, Marcel van Gerven
机构
*
Department of Machine Learning and Neural Computing, Donders Institute for Brain, Cognition and Behaviour, Radboud University(机器学习与神经计算系,多纳尔斯脑认知行为研究所,拉德堡德大学)
;
Cluster of Excellence Machine Learning, University of Tübingen(卓越机器学习集群,图宾根大学)
;
Department of Engineering, Control Group, University of Oxford(工程系,控制组,牛津大学)
Cost-Driven Representation Learning for Linear Quadratic Gaussian Control: Part I
基于成本驱动的线性二次高斯控制的状态表示学习:第一部分
Yi Tian, Kaiqing Zhang, Russ Tedrake, Suvrit Sra
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
University of Maryland, College Park(马里兰大学 College Park 分校)
;
Technical University Munich(慕尼黑技术大学)
Stealing That Free Lunch: Exposing the Limits of Dyna-Style Reinforcement Learning
Brett Barkley, David Fridovich-Keil
机构
*
Department of Computer Science, University of Texas at Austin, Austin, TX, USA(德克萨斯大学奥斯汀分校计算机科学系)
;
Department of Aerospace Engineering and Engineering Mechanics, University of Texas at Austin, Austin, TX, USA(德克萨斯大学奥斯汀分校航空航天工程与工程力学系)