LongVie 2: Multimodal Controllable Ultra-Long Video World Model
LongVie 2: 多模态可控超长视频世界模型
机构 * FDU(福建大学) ; NJU(南京大学) ; NTU(National University of Taiwan) ; NVIDIA(英伟达) ; THU(清华大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 通用世界模型 :world model(title,abstract);video world model(title,abstract);world model(title,abstract);video world model(title,abstract)
AI总结 LongVie 2通过多模态引导、退化感知训练和历史-上下文引导,实现了超长视频的可控生成,支持连续视频生成长达五分钟,推动视频世界建模的统一发展。
Comments Project Page: https://vchitect.github.io/LongVie2-project/