BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
BindWeave:通过跨模态整合实现主体一致的视频生成
机构 * University of Science and Technology of China(中国科学技术大学) ; ByteDance(字节跳动) ; National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家深空探测重点实验室,深空探测实验室)
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);MLLM(abstract);分类 cs.CV
AI总结 BindWeave通过跨模态整合解决主体一致视频生成难题,利用MLLM-DiT框架提升生成视频的主体一致性和自然度。
Comments Accepted by ICLR 2026