Reversal Q-Learning
逆向Q学习
机构 * University of California, Berkeley(加州大学伯克利分校)
AI总结 提出逆向Q学习(RQL)算法,通过扩展MDP框架和逆向流生成虚拟在线轨迹,结合偏差-方差缩减技术,实现基于流策略的离线强化学习,在50个机器人任务中取得最佳平均性能。
作者
Robotics / Reinforcement Learning
逆向Q学习
机构 * University of California, Berkeley(加州大学伯克利分校)
AI总结 提出逆向Q学习(RQL)算法,通过扩展MDP框架和逆向流生成虚拟在线轨迹,结合偏差-方差缩减技术,实现基于流策略的离线强化学习,在50个机器人任务中取得最佳平均性能。