Understanding Reward Hacking in Text-to-Image Reinforcement Learning
理解文本到图像强化学习中的奖励黑客行为
机构 * Department of Computer Science, University of California, Los Angeles(计算机科学系,加州大学洛杉矶分校)
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV
AI总结 本文提出了一种轻量的伪影奖励模型,用于缓解文本到图像强化学习中的奖励黑客问题,通过提高图像真实性和减少低质量生成。