Stabilized neural Hamilton--Jacobi--Bellman solvers: Error analysis and applications in model-based reinforcement learning
稳定神经哈密顿-雅可比-贝尔曼求解器:误差分析及在基于模型的强化学习中的应用
机构 * Seoul National University of Science and Technology(首尔科学技术大学) ; POSTECH ; Gachon University(成均馆大学)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);分类 cs.AI、cs.LG
AI总结 本文提出稳定神经HJB求解器,通过混合方法分析误差并应用于强化学习,验证了求解器在模型误差和策略不匹配下的稳定性。