2602.08794
2026-02-11
cs.CV
cs.SD
77%
MOVA: Towards Scalable and Synchronized Video-Audio Generation
MOVA:迈向可扩展且同步的视频-音频生成
OpenMOSS Team, Donghua Yu, Mingshu Chen, Qi Chen, Qi Luo, Qianyi Wu, Qinyuan Cheng, Ruixiao Li, Tianyi Liang, Wenbo Zhang, Wenming Tu, Xiangyu Peng, Yang Gao, Yanru Huo, Ying Zhu, Yinze Luo, Yiyang Zhang, Yuerong Song, Zhe Xu, Zhiyu Zhang, Chenchen Yang, Cheng Chang, Chushu Zhou, Hanfu Chen, Hongnan Ma, Jiaxi Li, Jingqi Tong, Junxi Liu, Ke Chen, Shimin Li, Shiqi Jiang, Songlin Wang, Wei Jiang, Zhaoye Fei, Zhiyuan Ning, Chunguo Li, Chenhui Li, Ziwei He, Zengfeng Huang, Xie Chen, Xipeng Qiu
专题命中
音频语音多模态
:multimodal(abstract);image-text(abstract);audio-visual(abstract);分类 cs.CV
AI总结
MOVA通过混合专家架构生成高质量同步音频视频内容,支持图像-文本到视频-音频的生成任务,推动开放研究与创作者社区发展。