Reward Modeling for Scientific Writing Evaluation
科学写作评估的奖励建模
机构 * Ubiquitous Knowledge Processing Lab (UKP Lab) Department of Computer Science and Hessian Center for AI (hessian.AI) Technical University of Darmstadt(普遍知识处理实验室(UKP实验室)计算机科学系海德堡人工智能中心(hessian.AI)达姆施塔特技术大学) ; Konrad Zuse School of Excellence in Learning and Intelligent Systems (ELIZA)(康拉德·祖斯卓越学习与智能系统学校(ELIZA))
AI总结 本文提出高效的开源奖励模型,通过两阶段训练框架提升科学写作评估的准确性和鲁棒性,实现跨任务泛化和动态评分标准适应。
Comments Accepted to ACL 2026 (Main). Project page: https://ukplab.github.io/acl2026-expert-rm/