When Vocal Tone and Literal Meaning Diverge: An Acoustic-Semantic Incongruity Study for Large Audio-Language Models
当语调与字面意义不一致时:面向大型音频语言模型的声学-语义不一致研究
AI总结 本研究针对LALMs在语调与字面意义不一致场景下的表现问题,构建CREMA-ASIS数据集,经实验发现其受语义主导且难识别不一致,监督式微调可显著提升其性能。
Comments EMNLP 2026 Findings