Mirror Descent Policy Optimisation for Robust Constrained Markov Decision Processes
镜像下降策略优化用于鲁棒约束马尔可夫决策过程
David M. Bossens, Atsushi Nitanda
机构
*
Centre for Frontier AI Research, Agency for Science, Technology and Research (A*STAR)(前沿人工智能研究中心,科技研究局(A*STAR))
;
Singapore Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(新加坡高性能计算研究所,科技研究局(A*STAR))
;
College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)