arXivDaily arXiv每日学术速递 周一至周五更新

作者

Chelsea Finn

Robotics / Machine Learning

2026-08-05 至 2026-08-05 共收录 1
2607.27203 2026-08-05 cs.LG 版本更新

Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?

在线RL微调真的需要预训练Q函数吗?

Perry Dong, Ron Polonsky, Dorsa Sadigh, Chelsea Finn

机构 * Stanford University(斯坦福大学)

AI总结 本文针对在线RL微调是否需预训练Q函数的问题,发现预训练Q函数增益有限,提出IPE方法,在连续控制基准中使微调性能平均提升1.26倍。

Comments Fixed typo in author name

详情

展开后加载摘要…

URL PDF HTML 收藏