Dialogue Is Not Enough to Make a Communicative BabyLM (But Neither Is Developmentally Inspired Reinforcement Learning)
对话不足以造就一个交际性的婴儿语言模型(但也不如发展启发式强化学习)
机构 * Center for Language and Cognition (CLCG), University of Groningen(语言与认知中心(CLCG)、格罗宁根大学) ; CRC 1646 – Linguistic Creativity in Communication, Bielefeld University(语言交流创造性研究(CRC 1646)、比尔特诺夫大学)
专题命中 后训练与偏好优化 :language model(abstract);small language model(abstract);分类 cs.CL
AI总结 本文探讨了仅通过对话数据预训练是否能生成有效的小型语言模型,并通过多种微调策略提升模型的交际能力,发现DPO微调在自定义对话基准测试中表现更优。
Journal ref Proceedings of the First BabyLM Workshop (2025), pp. 421-435