机构
*
Monash University(莫纳什大学)
;
Swinburne University of Technology(斯威本科技大学)
;
CSIRO’s Data61(澳大利亚联邦科学与工业研究组织(CSIRO)的数据61研究所)
;
The University of Melbourne(墨尔本大学)
专题命中
预训练与数据
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
Tracing Multilingual Factual Knowledge Acquisition in Pretraining
Yihong Liu, Mingyang Wang, Amir Hossein Kargaran, Felicia Körner, Ercong Nie, Barbara Plank, François Yvon, Hinrich Schütze
机构
*
Center for Information and Language Processing, LMU Munich(信息与语言处理中心,慕尼黑大学)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))
;
Bosch Center for Artificial Intelligence(博世人工智能中心)
;
Sorbonne Université, CNRS, ISIR, France(索邦大学,法国国家科学研究中心,ISIR)
专题命中
预训练与数据
:pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
University of Toronto(多伦多大学)
;
Qatar Computing Research Institute(卡塔尔计算研究院)
;
Daffodil International University(达芙妮国际大学)
;
Macquarie University(麦考瑞大学)
机构
*
Johns Hopkins University(约翰霍普金斯大学)
;
Liaoning Technical University(辽宁技术大学)
;
Microsoft Research Montréal(微软研究院蒙特利尔分校)
;
Central University of Finance and Economics(中央财经大学)
专题命中
预训练与数据
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
Comments14 pages,15 figures, Accepted to the 5th Wordplay: When Language Meets Games Workshop, EMNLP 2025
Can Code Language Models Learn Clarification-Seeking Behaviors?
Jie JW Wu, Manav Chaudhary, Davit Abrahamyan, Arhaan Khaku, Anjiang Wei, Fatemeh H. Fard
机构
*
Michigan Technological University(密歇根技术大学)
;
Indian Institute of Information Technology (IIIT)(印度信息科技研究所)
;
University of California, San Diego (UCSD)(加州大学圣地亚哥分校)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Stanford University(斯坦福大学)
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG
Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks
Sheng Liu, Qiang Sheng, Danding Wang, Yang Li, Guang Yang, Juan Cao
机构
*
Sheng Liu Media Synthesis and Forensics Lab, Institute of Computing Technology, Chinese Academy of Sciences University of Chinese Academy of Sciences(媒体合成与取证实验室,计算技术研究所,中国科学院,中国科学院大学)
;
Qiang Sheng Media Synthesis and Forensics Lab, Institute of Computing Technology, Chinese Academy of Sciences(媒体合成与取证实验室,计算技术研究所,中国科学院)
;
Danding Wang Media Synthesis and Forensics Lab, Institute of Computing Technology, Chinese Academy of Sciences(媒体合成与取证实验室,计算技术研究所,中国科学院)
;
Yang Li Media Synthesis and Forensics Lab, Institute of Computing Technology, Chinese Academy of Sciences University of Chinese Academy of Sciences(媒体合成与取证实验室,计算技术研究所,中国科学院,中国科学院大学)
;
Guang Yang Zhongguancun Laboratory(中关村实验室)
;
Juan Cao Media Synthesis and Forensics Lab, Institute of Computing Technology, Chinese Academy of Sciences(媒体合成与取证实验室,计算技术研究所,中国科学院)
专题命中
预训练与数据
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Population Health Sciences, Weill Cornell Medicine(人口健康科学系,韦尔·科恩医学中心)
;
Donald Bren School of Information and Computer Sciences, University of California, Irvine(唐纳德·布伦信息与计算机科学学院,加州大学伊尔弗分校)
专题命中
预训练与数据
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
OmniMRI: A Unified Vision--Language Foundation Model for Generalist MRI Interpretation
Xingxin He, Aurora Rofena, Ruimin Feng, Haozhe Liao, Zhaoye Zhou, Albert Jang, Fang Liu
机构
*
Athinoula A. Martinos Center for Biomedical Imaging(阿提诺拉A.马丁诺斯生物医学成像中心)
;
Harvard Medical School(哈佛医学院)
;
Massachusetts General Hospital(麻省总医院)
;
University Campus Bio-Medico of Rome(罗马生物医学大学校园)
机构
*
School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机科学学院)
;
Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
Ant Group, Beijing, China(蚂蚁集团(北京))
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL