Adapting Speech Language Model to Singing Voice Synthesis
将语音语言模型适应于歌唱语音合成
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Renmin University of China(中国人民大学) ; John Hopkins University(约翰霍普金斯大学)
AI总结 本文提出将预训练语音语言模型适应于歌唱语音合成,通过多流语言模型预测、条件流匹配生成梅尔频谱图及梅尔到波形 vocoder 实现,验证了模型在歌唱语音合成任务中的有效性。
Comments Accepted by NeurIPS 2025 workshop AI for Music