Alignment Tuning for Large Language Models: A Data-Centric Lens on Alignment Data Pipelines
大型语言模型的对齐调优:以数据为中心的对齐数据管道视角
机构 * KAIST(韩国科学技术院)
AI总结 本文以数据为中心,将对齐调优重构为管道设计问题,分解为响应合成、偏好评估和偏好实例化三个阶段,并基于此框架统一分类现有对齐方法,总结设计权衡与失败模式,提炼高层原则,最后指出开放挑战。
Comments Accepted at the Findings of ACL 2026