Audio Super-Resolution with Latent Bridge Models
基于潜在桥模型的音频超分辨率
机构 * Department of CST, Tsinghua University, Beijing, China(计算机科学与技术系,清华大学,北京,中国) ; Shengshu AI, Beijing, China(盛舒人工智能,北京,中国) ; USTC, Hefei, China(中国科学技术大学,合肥,中国)
专题命中 图像修复 :diffusion(abstract)
AI总结 本文提出基于潜在桥模型的音频超分辨率方法,通过压缩音频到潜在空间并设计桥模型,实现高质量的任意到48kHz和192kHz音频上采样。
Comments Accepted at NeurIPS 2025