"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
对不起,我没听清那个:语音模型忽视最关键的东西
机构 * TogetherAI ; Cornell University(康奈尔大学) ; Stanford University(斯坦福大学)
AI总结 该研究发现语音模型在现实应用中对高风险短语音转录存在显著误差,通过合成数据生成方法显著提升了非英语主要说话人的转录准确性。
Comments Preprint