StochasTok: Improving Fine-Grained Subword Understanding in LLMs
StochasTok:提升大语言模型的细粒度子词理解
机构 * FLAIR, University of Oxford(FLAIR,牛津大学) ; University of Oxford(牛津大学) ; National University of Singapore(新加坡国立大学) ; University of British Columbia(不列颠哥伦比亚大学)
专题命中 预训练与数据 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 本文提出StochasTok,一种高效的随机分词方法,通过在训练中随机分割token,提升LLM在子词层面的任务表现,包括字符计数和数学任务。