EMO-R3: Reflective Reinforcement Learning for Emotional Reasoning in Multimodal Large Language Models
EMO-R3:多模态大语言模型中用于情感推理的反射强化学习
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; MiLM Plus, Xiaomi Inc.(小米公司)
AI总结 针对多模态大语言模型情感推理难题,提出EMO-R3框架。引入结构化情感思维并设计反射情感奖励,经大量实验验证,该框架显著提升模型可解释性与情商,在多视觉情感理解基准测试中表现出色。
Comments Accepted by CVPR 2026