SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation
SonicWeave:用于统一音频场景生成的分块路由混合专家模型
机构 * Kuaishou Technology(快手科技) ; The Chinese University of Hong Kong(香港中文大学) ; Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
AI总结 本文提出SonicWeave,一种带CPE-MoE的流匹配模型,可通过单一权重集生成含语音、音乐等的统一音频场景,在多项基准及复杂场景评估中表现优于基线。