Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement
具有对齐检测和局部细化的自纠正文本到视频生成
机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) ; NTU Singapore(新加坡国立大学) ; Allen Institute for AI(人工智能研究院) ; Johns Hopkins University(约翰霍普金斯大学)
AI总结 本文提出VideoRepair框架,通过检测并修正视频与文本提示的对齐问题,提升生成质量。框架分为三个阶段,保留正确生成区域并针对性修正错误部分,有效提升多种对齐指标。
Comments Accepted to ACL 2026 Findings. Project page: https://video-repair.github.io