Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
机构 * University at Buffalo(布法罗大学) ; Adobe Research(Adobe研究) ; Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments Accepted at ICCV 2025. Code available at https://github.com/sjz5202/LLaVA-Reward