AffectOmni: RL-Verifiable People-Centric Grounded Affective Reasoning for Social and Art-Related Scenes
AffectOmni:面向社交与艺术相关场景的可通过强化学习验证的以人为中心的接地情感推理
机构 * Lanzhou University(兰州大学) ; Hainan University(海南大学) ; National University of Singapore(新加坡国立大学)
专题命中 后训练与偏好优化 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 AffectOmni是面向社交与艺术场景的可验证情感推理框架,通过GRPO训练,引入两类奖励优化以人为中心的证据选择与时间推理,经多数据集实验较7B基线实现显著性能提升。
Comments 12 pages, 5 figures