Improving monotonic optimization in heterogeneous multi-agent reinforcement learning with optimal marginal deterministic policy gradient
机构 * School of Computer Science and Technology, Beijing Jiaotong University, Beijing 100044, China(计算机科学与技术学院,北京交通大学,北京100044,中国) ; Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence(交通数据挖掘与具身智能北京市重点实验室)
专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI