DeepVideo-R1: Video Reinforcement Fine-Tuning via Difficulty-aware Regressive GRPO
DeepVideo-R1: 通过难度感知的回归GRPO实现视频强化微调
机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) ; Korea University(韩国大学)
专题命中 其他视频模型 :video reasoning(abstract);分类 cs.CV
AI总结 DeepVideo-R1通过回归GRPO和难度感知数据增强,提升视频大语言模型的推理能力。
Comments NeurIPS 2025