Quantifying the Agreement Between Data-Influence and Data-Similarity to Understand LLM Behavior
量化数据影响与数据相似性之间的一致性以理解LLM行为
Christopher J. Anders, Henrique Da Silva Gameiro, Nico Daheim, Mohammad Emtiyaz Khan
机构
*
RIKEN Center for Advanced Intelligence Project, Tokyo, Japan(日本东京理化学研究所先进智能项目中心)
;
Section of Computer Science, EPFL Lausanne, Switzerland(瑞士洛桑联邦理工学院计算机科学系)
;
Ubiquitous Knowledge Processing Lab (UKP Lab), Department of Computer Science, Technical University of Darmstadt(达姆施塔特工业大学计算机科学系泛在知识处理实验室)
;
National Research Center for Applied Cybersecurity ATHENE, Germany(德国国家应用网络安全研究中心ATHENE)
;
TU Darmstadt & Hessian Center for AI (hessian.AI), Darmstadt, Germany(达姆施塔特工业大学与黑森州人工智能中心)
20/20 Vision Language Models: A Prescription for Better VLMs through Data Curation Alone
20/20 Vision Language Models: 通过数据整理单独提升VLMs的方案
DatologyAI, :, Siddharth Joshi, Haoli Yin, Rishabh Adiga, Haakon Mongstad, Alvin Deng, Aldo Carranza, Alex Fang, Amro Abbas, Anshuman Suri, Brett Larsen, Daniel Zayas, Darren Teh, David Schwab, Diego Kiner, Fan Pan, Jack Urbanek, Jason Lee, Jason Telanoff, Josh Wills, Kaleigh Mentzer, Luke Merrick, Maximilian Böther, Parth Doshi, Paul Burstein, Pratyush Maini, Ties Robroek, Tony Jiang, Vidhi Jain, Vineeth Dorna, Zhengping Wang, Bogdan Gaza, Ari Morcos, Matthew Leavitt
Comments13 pages, including AAAI Paper Checklist. Accepted in Proceedings of the 20th International AAAI Conference on Web and Social Media (ICWSM 2026)
Towards Building Non-Fine-Tunable Foundation Models
构建不可微调的基础模型
Ziyao Wang, Nizhang Li, Pingzhi Li, Guoheng Sun, Tianlong Chen, Ang Li
机构
*
University of Maryland, College Park(马里兰大学 College Park 分校)
;
Macau University of Science and Technology(澳门科学技术大学)
;
The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中
预训练与数据
:foundation model(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)
SongSage: A Large Musical Language Model with Lyric Generative Pre-training
SongSage:一种具有歌词生成预训练的大型音乐语言模型
Jiani Guo, Jiajia Li, Jie Wu, Zuchao Li, Yujiu Yang, Ping Wang
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
School of Information Management, Wuhan University(武汉大学信息管理学院)
;
Tsinghua University(清华大学)
;
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);pretraining(abstract);SFT(abstract)
Native Design Bias: Studying the Impact of English Nativeness on Language Model Performance
Manon Reusens, Philipp Borchert, Jochen De Weerdt, Bart Baesens
机构
*
Research Centre for Information Systems Engineering (LIRIS), KU Leuven(信息系统工程研究中心(LIRIS),库勒文大学)
;
IESEG School of Management(IESEG管理学院)
;
Department of Decision Analytics and Risk, University of Southampton(决策分析与风险系,南安普顿大学)
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)
ADEPT: Continual Pretraining via Adaptive Expansion and Dynamic Decoupled Tuning
Jinyang Zhang, Yue Fang, Hongxin Ding, Weibin Liao, Muyang Ye, Xu Chu, Junfeng Zhao, Yasha Wang
机构
*
Key Laboratory of High Confidence Software Technologies, Ministry of Education(高可信软件技术重点实验室,教育部)
;
School of Computer Science, Peking University(北京大学计算机学院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
专题命中
预训练与数据
:pretraining(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)