RE-PO: Robust Enhanced Policy Optimization as a General Framework for LLM Alignment
RE-PO:一种用于大语言模型对齐的鲁棒增强策略优化通用框架
机构 * IDSS, Massachusetts Institute of Technology(IDSS,麻省理工学院) ; EE, Tsinghua University(电子工程系,清华大学) ; Li Auto Inc.(力汽车公司) ; SIGS, Tsinghua University(系统工程系,清华大学)
AI总结 RE-PO是一种用于大语言模型对齐的鲁棒增强策略优化通用框架,通过期望最大化程序推断标签正确性并自适应加权数据点以减轻噪声,提升对齐效果。