CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
通过统一多模态视频扩散实现可控视频生成
机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室) ; Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院) ; Tsinghua University(清华大学)
专题命中 视频生成 :video generation(title,abstract);video diffusion(title);video understanding(abstract);分类 cs.CV
AI总结 CtrlVDiff通过统一多模态视频扩散模型,实现可控视频生成,支持多模态输入并提升生成的可控性和保真度。
Comments 27 pages, 18 figures, 9 tables. Project page: https://tele-ai.github.io/CtrlVDiff/