Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities
在大语言模型、多模态大语言模型及更广泛的领域中进行模型融合:方法、理论、应用与机遇
Enneng Yang, Li Shen, Guibing Guo, Xingwei Wang, Xiaochun Cao, Jie Zhang, Dacheng Tao
机构
*
Shenzhen Campus of Sun Yat-sen University, China(中山大学深圳校区)
;
Northeastern University China(东北大学)
;
Shenzhen Campus of Sun Yat-sen University China(中山大学深圳校区)
;
Nanyang Technological University Singapore(南洋理工大学)
;
Northeastern University(东北大学)
;
Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)
;
Nanyang Technological University(南洋理工大学)
;
Institute for Clarity in Documentation Dublin Ohio USA(文档清晰研究所)
;
Inria Paris-Rocquencourt Rocquencourt France(巴黎-罗quentourt研究所)
;
Rajiv Gandhi University Doimukh Arunachal Pradesh India(拉贾·甘地大学)
;
Tsinghua University Haidian Qu Beijing Shi China(清华大学)
;
Palmer Research Laboratories San Antonio Texas USA(帕勒研究中心)
;
Institute for Clarity in Documentation(文档清晰研究所)
;
Inria Paris-Rocquencourt(巴黎-罗quentourt研究所)
;
Rajiv Gandhi University(拉贾·甘地大学)
;
Tsinghua University(清华大学)
;
Palmer Research Laboratories(帕勒研究中心)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
VADTree: Explainable Training-Free Video Anomaly Detection via Hierarchical Granularity-Aware Tree
VADTree: 通过分层粒度感知树实现可解释的无训练视频异常检测
Wenlong Li, Yifei Xu, Yuan Rao, Zhenhua Wang, Shuiguang Deng
机构
*
School of Software, Xi’an Jiaotong University(西安交通大学软件学院)
;
China Railway Xi’an Group(中国铁路西安集团)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
专题命中
预训练与数据
:large language model(abstract);language model(abstract)
ITDR: An Instruction Tuning Dataset for Enhancing Large Language Models in Recommendations
ITDR: 一个用于增强推荐系统中大语言模型的指令微调数据集
Zekun Liu, Xiaowen Huang, Jitao Sang
机构
*
Beijing Jiaotong University School of Computer Science
;
Technology Beijing Key Laboratory of Traffic Data Mining
;
Embodied Intelligence Key Laboratory of Big Data \& Artificial Intelligence in Transportation, Ministry of Education Beijing China
;
Beijing Jiaotong University
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.AI
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences(中国科学院香港创新科学研究院人工智能与机器人中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Fujian Key Laboratory of Pattern Recognition and Image Understanding, School of Computer and Information Engineering, Xiamen University of Technology(福建 pattern recognition and image understanding 工程学院,厦门大学科技学院)
专题命中
指令微调
:instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
Constrained Language Model Policy Optimization via Risk-aware Stepwise Alignment
通过风险感知的逐步对齐实现约束语言模型策略优化
Lijun Zhang, Lin Li, Wei Wei, Yajie Qi, Huizhong Song, Jun Wang, Yaodong Yang, Jiye Liang
机构
*
Key Laboratory of Computational Intelligence and Chinese Information Processing of Ministry of Education, School of Computer and Information Technology, Shanxi University(教育部计算智能与中文信息处理重点实验室,计算机与信息技术学院,山西大学)
;
University College London(伦敦大学学院)
;
Institute for AI, Peking University(北京大学人工智能研究院)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)
;
Tsinghua University(清华大学)
;
Wuhan AI Research(武汉人工智能研究所)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL
机构
*
Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(上海智能信息处理关键实验室,计算机科学与人工智能学院,复旦大学)
;
Artificial Intelligence, Fudan University(人工智能,复旦大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.AI
Fuyu Dong, Ke Li, Di Wang, Nan Luo, Yiming Zhang, Kaiyu Li, Jianfei Yang, Quan Wang
机构
*
School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院)
;
Department of Mathematics, University of California, San Diego(加州大学圣地亚哥分校数学系)
;
School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院)