Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?
在线RL微调真的需要预训练Q函数吗?
机构 * Stanford University(斯坦福大学)
AI总结 本文针对在线RL微调是否需预训练Q函数的问题,发现预训练Q函数增益有限,提出IPE方法,在连续控制基准中使微调性能平均提升1.26倍。
Comments Fixed typo in author name
作者
Robotics / Machine Learning
在线RL微调真的需要预训练Q函数吗?
机构 * Stanford University(斯坦福大学)
AI总结 本文针对在线RL微调是否需预训练Q函数的问题,发现预训练Q函数增益有限,提出IPE方法,在连续控制基准中使微调性能平均提升1.26倍。
Comments Fixed typo in author name