V-Rubrics: Visual Faithfulness via Rubric-Based Reinforcement Learning
V-Rubrics:基于评分规则的强化学习实现视觉忠实性
机构 * S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab) ; UIUC(伊利诺伊大学厄巴纳-香槟分校) ; A*STAR(新加坡科技研究局)
AI总结 该研究针对视觉-语言模型回答缺乏视觉依据的问题,提出基于评分规则的强化学习方法V-Rubrics,通过分解响应为原子命题并从三方面评分,训练的模型在相关推理基准上性能优于基线。
Comments Proj page: this https URL (https://shulin16.github.io/v-rubrics/)