Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning
Ground-R1: 通过强化学习激励基于地面的视觉推理
机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) ; Peking University(北京大学) ; University of Science and Technology of China(中国科学技术大学) ; Sun Yat-sen University(中山大学)
专题命中 视觉推理 :visual reasoning(title);vision-language model(abstract);grounding(abstract);分类 cs.CV
AI总结 Ground-R1 通过 Scale Relative Policy Optimization 方法,解决 LVLM 在视觉证据 grounding 方面的偏差问题,提升推理准确性和证据 grounding 能力。