Understanding Reward Hacking in Text-to-Image Reinforcement Learning
理解文本到图像强化学习中的奖励黑客行为
机构 * Department of Computer Science, University of California, Los Angeles(计算机科学系,加州大学洛杉矶分校)
AI总结 本文提出了一种轻量的伪影奖励模型,用于缓解文本到图像强化学习中的奖励黑客问题,通过提高图像真实性和减少低质量生成。
高校专区
理解文本到图像强化学习中的奖励黑客行为
机构 * Department of Computer Science, University of California, Los Angeles(计算机科学系,加州大学洛杉矶分校)
AI总结 本文提出了一种轻量的伪影奖励模型,用于缓解文本到图像强化学习中的奖励黑客问题,通过提高图像真实性和减少低质量生成。