Scaling Laws for Downstream Task Performance of Large Language Models
大语言模型下游任务性能的扩展定律
机构 * Google Research(谷歌研究) ; OpenAI(开放人工智能) ; Stanford University(斯坦福大学)
专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG
AI总结 本研究探讨了预训练数据规模和分布对齐对大语言模型下游任务性能的影响,揭示了扩展定律在迁移学习中的应用及翻译质量的预测方法。
Comments Published at the International Conference on Learning Representations (ICLR) 2025, with title: "Scaling Laws for Downstream Task Performance in Machine Translation"