PIKA: Expert-Level Synthetic Datasets for Post-Training Alignment from Scratch
PIKA:从零开始的专家级合成数据集用于训练后对齐
机构 * University of California, Riverside(加州大学河滨分校) ; Microsoft AI(微软人工智能)
专题命中 后训练与偏好优化 :post-training(title);LLM(abstract);SFT(abstract);preference optimization(abstract)
AI总结 PIKA通过高效的数据集提升对齐效果,仅用3万例超越大规模数据集,在AlpacaEval 2.0等基准测试中表现优异,且提供高质量偏好优化数据,降低数据需求,促进资源受限研究。