Generative vs. Encoder Large Language Models for ASR Evaluation: A Comparative Study
用于ASR评估的生成式与编码器大型语言模型:一项比较研究
机构 * Idiap Research Institute(伊迪亚普研究所) ; Avignon Université(阿维尼翁大学) ; Le Mans Université(勒芒大学) ; Nantes Université(南特大学)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL
AI总结 该研究对比生成式与编码器大型语言模型在ASR评估中的应用,发现合理配置的BERTScore、SemDist与人类判断相关性强,生成式LLMs可提升评估可解释性。