AlignTune: Modular Toolkit for Post-Training Alignment of Large Language Models
AlignTune: 大型语言模型后训练对齐的模块化工具包
机构 * Lexsi Labs(Lexsi实验室)
专题命中 偏好对齐 :alignment(title,abstract);RLHF(abstract);分类 cs.CL、cs.LG
AI总结 AlignTune通过模块化工具包提供统一接口,支持监督微调和RLHF优化,解决后端干扰和不可复现问题,提升对齐研究的可控性和复现性。
Comments Library opensource and available at https://github.com/Lexsi-Labs/aligntune