Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
机构 * University at Buffalo(布法罗大学) ; Adobe Research(Adobe研究) ; Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
Comments Accepted at ICCV 2025. Code available at https://github.com/sjz5202/LLaVA-Reward