Reinforcing Structured Chain-of-Thought for Video Understanding
强化结构链式思考以提升视频理解
机构 * Stony Brook University(石溪大学) ; Amazon(亚马逊)
AI总结 本文提出SDRL框架,通过结构化链式思考格式和自监督机制,解决多模态大语言模型在视频理解中的推理漂移和时间感知问题,实现单阶段强化学习,提升模型泛化能力。
Comments Accepted to CVPR 2026 (Main Conference)