arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Meituan(美团)

2026-01-27 至 2026-01-27 共收录 2
2601.18281 2026-01-27 cs.CL cs.SD

Reflecting Twice before Speaking with Empathy: Self-Reflective Alternating Inference for Empathy-Aware End-to-End Spoken Dialogue

在富有同理心之前两次反思:用于富有同理心的端到端语音对话的自我反思交替推理

Yuhang Jia, Pei Liu, Haoqin Sun, Jiaming Zhou, Xuxin Cheng, Cao Liu, Ke Zeng, Xunliang Cai, Yong Qin

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) Meituan LongCat Interaction Team(美团LongCat交互团队)

AI总结 ReEmpathy通过自我反思交替推理机制提升语音对话的同理心表现,实现更情感智能的人机交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14175 2026-01-27 cs.CL cs.AI

GRAM: A Generative Foundation Reward Model for Reward Generalization

GRAM:一种用于奖励泛化的大规模生成式奖励模型

Chenglong Wang, Yang Gan, Yifu Huo, Yongyu Mu, Qiaozhi He, Murun Yang, Bei Li, Tong Xiao, Chunliang Zhang, Tongran Liu, Jingbo Zhu

机构 * School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院) NiuTrans Research, Shenyang, China(NiuTrans研究) CAS Key Laboratory of Behavioral Science, Institute of Psychology, CAS, Beijing, China(中国科学院行为科学重点实验室) Meituan Inc.(美团公司)

AI总结 GRAM提出了一种生成式奖励模型,通过结合无监督和监督学习,提升奖励模型在多种任务上的泛化能力,有效改进了基线模型的性能。

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏