Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
Zheng Wei, Mingchen Li, Zeqian Zhang, Ruibin Yuan, Pan Hui, Huamin Qu, James Evans, Maneesh Agrawala, Anyi Rao
机构
*
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
University of Chicago(芝加哥大学)
;
Stanford University(斯坦福大学)
机构
*
Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(上海智能信息处理关键实验室,复旦大学计算机学院)
;
Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心)
;
Microsoft Research Asia(微软亚洲研究院)
Improving the Physics of Video Generation with VJEPA-2 Reward Signal
Jianhao Yuan, Xiaofeng Zhang, Felix Friedrich, Nicolas Beltran-Velez, Melissa Hall, Reyhane Askari-Hemmat, Xiaochuang Han, Nicolas Ballas, Michal Drozdzal, Adriana Romero-Soriano
机构
*
FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)
;
University of Oxford(牛津大学)
;
Mila - Québec AI Institute(魁北克人工智能研究所)
;
Université de Montréal(蒙特利尔大学)
;
Columbia University(哥伦比亚大学)
;
McGill University(麦吉尔大学)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能 chair)
专题命中
视频生成
:video generation(title);分类 cs.CV
Comments2 pages
Journal refWinning entry of the ICCV 2025 Physics IQ Challenge