Risk-Averse Constrained Reinforcement Learning with Optimized Certainty Equivalents
具有优化确定等价的风险厌恶约束强化学习
机构 * Yale University(耶鲁大学) ; King’s College London(伦敦国王学院) ; Cisco Systems Inc.(思科系统公司)
AI总结 本文提出一种基于优化确定等价的风险厌恶约束强化学习框架,通过增强鲁棒性和算法收敛性,提升高风险环境下的决策可靠性。
Comments NeurIPS 2025