Flow Matching-Based Speech Source Separation with Best-of-N Biometric Sampling
基于最佳N生物特征采样的流匹配语音源分离
机构 * NVIDIA(英伟达)
AI总结 针对单通道语音分离难题,提出基于条件流匹配的方法,训练时用冻结说话人编码器定义源顺序,推理时用于生物特征最佳N候选选择等,在Libri2Mix基准上评估,该方法在分离指标及下游任务中表现出色。
Comments Accepted at the ICML 2026 Workshop on Machine Learning for Audio