AfriqueLLM: How Data Mixing and Model Architecture Impact Continued Pre-training for African Languages
AfriqueLLM: 数据混合与模型架构如何影响非洲语言的持续预训练
Hao Yu, Tianyi Xu, Michael A. Hedderich, Wassim Hamidouche, Syed Waqas Zamir, David Ifeoluwa Adelani
机构
*
McGill University(麦吉尔大学)
;
Mila-Quebec AI Institute(魁北克AI研究所)
;
LMU Munich & Munich Center for Machine Learning(慕尼黑大学及慕尼黑机器学习中心)
;
Microsoft AI for Good Research Lab(微软AI for Good研究实验室)
Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery
Science Earth: 迈向面向AI原生科学发现的行星级操作系统
Zhe Zhao, Haibin Wen, Yingcheng Wu, Jiaming Ma, Yifan Wen, Jinglin Jian, Jiacheng Ge, Xiangru Tang, Bo An, Ming Yin, Sanfeng Wu, Mengdi Wang, Le Cong
机构
*
Department of Pathology, Department of Genetics, Stanford University School of Medicine(病理学系、遗传学系,斯坦福大学医学院)
;
Princeton AI Lab, Department of Electrical & Computer Engineering, Princeton University(普林斯顿人工智能实验室、电气与计算机工程系,普林斯顿大学)
;
Scripps Research, La Jolla, CA, USA(斯克里普斯研究机构,洛杉矶,加利福尼亚州,美国)
;
Division of Biostatistics, Department of Population Health, New York University Grossman School of Medicine(生物统计学部、人口健康系,纽约大学格罗斯曼医学院)
;
College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)
;
Department of Computer Science, Yale University(计算机科学系,耶鲁大学)
;
Department of Physics, Princeton University(物理系,普林斯顿大学)
CommentsWithdrawn by the authors. (1) The author list and authorship roles had not been finalized and agreed upon by all listed authors prior to submission. (2) The specific contribution of the system in the K3 synchronization example (Section on Kuramoto/nonlinear physics) requires further validation before it can be reported. The authors are addressing both points and may resubmit a corrected version.
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Jinesis Lab, University of Toronto & Vector Institute(Jinesis实验室,多伦多大学及向量研究所)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Princeton University(普林斯顿大学)
;
Cornell University(康奈尔大学)
;
The University of Tokyo(东京大学)
;
RIKEN AIP(日本理化学研究所AIP)
;
Max Planck Institute for Intelligent Systems, Tübingen, Germany(德国图宾根最大计划智能系统研究所)
;
EuroSafeAI
Operationalising the Superficial Alignment Hypothesis via Task Complexity
通过任务复杂度操作化浅层对齐假设
Tomás Vergara-Browne, Darshan Patil, Ivan Titov, Siva Reddy, Tiago Pimentel, Marius Mosbach
机构
*
University of Maryland(马里兰大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
University of Edinburgh(爱丁堡大学)
AlphaOPT: Formulating Optimization Programs with Self-Improving LLM Experience Library
AlphaOPT: 利用自改进LLM经验库构建优化问题
Minwei Kong, Ao Qu, Xiaotong Guo, Wenbin Ouyang, Chonghe Jiang, Han Zheng, Yining Ma, Dingyi Zhuang, Yuhan Tang, Junyi Li, Shenhao Wang, Haris Koutsopoulos, Hai Wang, Cathy Wu, Jinhua Zhao
机构
*
Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联合研究技术联盟)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of Florida(佛罗里达大学)
;
Northeastern University(东北大学)
;
Singapore Management University(新加坡管理学院)