Provably Optimal Reinforcement Learning under Safety Filtering
在安全过滤下可证明最优的强化学习
专题命中 安全训练 :safety(title,abstract);分类 cs.LG
AI总结 本文证明在安全过滤下强化学习可实现最优性能,通过安全关键MDP和过滤MDP的理论框架,展示安全与性能优化的分离,并验证了在安全过滤器下的训练和部署方法。
Comments Accepted for publication in the proceedings of The International Association for Safe & Ethical AI (IASEAI) 2026; 17 pages, 3 figures