MME-Emotion: A Holistic Evaluation Benchmark for Emotional Intelligence in Multimodal Large Language Models
MME-Emotion:多模态大语言模型情感智能的综合评估基准
机构 * The Chinese University of Hong Kong(香港中文大学) ; Tongyi Lab(通义实验室) ; SZTU(深圳技术大学) ; Peking University(北京大学) ; Tongji University(同济大学) ; CASIA(中国科学院自动化所) ; Tencent(腾讯) ; UCLA(加州大学洛杉矶分校) ; Westlake University(西湖大学) ; NTU(国立大学)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI
AI总结 MME-Emotion是首个评估多模态大语言模型情感智能的综合基准,揭示当前模型在情感识别和推理上的不足,并通过多智能体框架提供混合指标分析。