SparsePO: Controlling Preference Alignment of LLMs via Sparse Token Masks
机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) ; University College London(伦敦大学学院)
专题命中 偏好对齐 :alignment(title,abstract);harmlessness(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 27 pages, 9 figures, 5 tables. Accepted to EMNLP 2025