Late-to-Early Training: LET LLMs Learn Earlier, So Faster and Better
后期到早期训练:LET LLMs 早期学习,从而更快且更好
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 本文提出LET范式,通过利用已有小型预训练模型加速大模型训练,实现更快的训练速度和更高的性能。