SPEARBench: A Benchmark for Naturalness Evaluation in Streaming Speech-to-Speech Language Models
SPEARBench:面向流式语音转语音语言模型的自然度评估基准
机构 * Department of Electrical and Computer Engineering, Johns Hopkins University(约翰霍普金斯大学电气与计算机工程系) ; Amazon Inc.(亚马逊公司)
AI总结 针对现有基准无法评估流式语音转语音模型对话自然度的问题,构建多维度评估基准SPEARBench,可从多维度评测模型,发现当前模型在多类对话行为维度仍与人类存在差距。
Comments Corresponding Website: https://thomasthebaud.github.io/SPEAR-benchmark-website/#welcome