VR-Thinker: Boosting Video Reward Models through Thinking-with-Image Reasoning
VR-Thinker: 通过图像推理提升视频奖励模型
机构 * CUHK MMLab(香港中文大学多模态实验室) ; Kling Team, Kuaishou Technology(快手技术 Kling 团队) ; Nanjing University(南京大学)
AI总结 本文提出VR-Thinker框架,通过图像推理操作和可配置视觉记忆窗口提升视频奖励模型的推理精度与可靠性,实现在视频偏好基准测试中达到最优性能。