AlignTune: Modular Toolkit for Post-Training Alignment of Large Language Models
AlignTune: 大型语言模型后训练对齐的模块化工具包
机构 * Lexsi Labs(Lexsi实验室)
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);SFT(abstract)
AI总结 AlignTune通过模块化工具包提供统一接口,支持监督微调和RLHF优化,解决后端干扰和不可复现问题,提升对齐研究的可控性和复现性。
Comments Library opensource and available at https://github.com/Lexsi-Labs/aligntune