LongVPO: From Anchored Cues to Self-Reasoning for Long-Form Video Preference Optimization
LongVPO:从锚定线索到自我推理的长视频偏好优化
机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) ; JIUTIAN Research(Jiutian研究) ; Shanghai AI Laboratory(上海人工智能实验室)
AI总结 LongVPO通过两阶段直接偏好优化框架,利用合成数据和递归标注流程,在无需长视频标注的情况下实现高效长视频理解,优于现有开源模型并保持短视频性能。
Comments NeurIPS 2025