Tracing the Representation Geometry of Language Models from Pretraining to Post-training
机构 * Computer Science, McGill University(麦吉尔大学计算机科学系) ; Mila - Quebec AI Institute(魁北克人工智能研究所) ; UC Berkeley(加州大学伯克利分校) ; G o o g l e , Paradigms of Intelligence Team(谷歌,智能范式团队) ; Mathematics and Statistics, Université de Montréal(蒙特利尔大学数学与统计学系) ; Neurology & Neurosurgery and Montreal Neurological Institute, McGill University(神经病学与神经外科及蒙特利尔神经研究所,麦吉尔大学) ; CIFAR Learning in Machines & Brains Program(CIFAR 机器与大脑学习计划)
专题命中 后训练与偏好优化 :language model(title,abstract);pretraining(title,abstract);post-training(title,abstract);large language model(abstract)
Comments 33 pages, 14 figures, 9 tables