arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Robot Learning · 会议 · Robotics

2026-01-19 至 2026-01-19 共收录 1
2509.09863 2026-01-19 eess.SY cs.LG cs.RO cs.SY

Off Policy Lyapunov Stability in Reinforcement Learning

强化学习中的非策略李雅普诺夫稳定性

Sarvan Gill, Daniela Constantinescu

机构 * Department of Mechanical Engineering University of Victoria, Canada(机械工程系维多利亚大学)

AI总结 本文提出非策略李雅普诺夫函数学习方法,将其应用于软演员批评者和近端策略优化算法,提升其数据效率和稳定性保证。

Comments Conference on Robot Learning (CORL) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏