EPTS: Elastic Post-Training Sparsity for Efficient Large Language Model Compression
EPTS:弹性后训练稀疏性用于高效大型语言模型压缩
Ke Xu, Jiaqi Wan, Wenhao Hu, Han Pu, Xiaoyun Wang
机构
*
School of Artificial Intelligence(人工智能学院)
;
Anhui University(安徽大学)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Tiangong University(天工大学)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG
机构
*
Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
;
School of Computing and Information Technology, Great Bay University(大湾区大学计算机科学与技术学院)
;
School of Engineering, Westlake University(西湖大学工学院)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning
EquivPruner:通过动作剪枝提升基于LLM的搜索效率与质量
Jiawei Liu, Qisi Chen, Jianshu Zhang, Quan Liu, Defu Lian
机构
*
School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)
;
Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)
;
iFLYTEK Research(iFLYTEK研究院)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Online LLM Selection via Constrained Bandits with Time-Varying Demand
基于时变需求的约束赌博机在线LLM选择
Yin Huang, Qingsong Liu, Jie Xu
机构
*
Department of Electrical and Computer Engineering, University of Florida(佛罗里达大学电气与计算机工程系)
;
Manning College of Information and Computer Sciences, University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校曼宁信息与计算机科学学院)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
The Pragmatic Persona: Discovering LLM Persona through Bridging Inference
实用人格:通过桥接推理发现LLM人格
Jisoo Yang, Jongwon Ryu, Minuk Ma, Trung X. Pham, Junyeong Kim
机构
*
Department of Artificial Intelligence, Chung-Ang University, Seoul, 06974, Republic of Korea(Chung-Ang大学人工智能系)
;
Department of Computer Science, University of British Columbia, Vancouver, BC V6T 1Z4, Canada(不列颠哥伦比亚大学计算机科学系)
;
Van Lang University, Ho Chi Minh City, Vietnam(文-lang大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波数字孪生研究院,东方理工大学(宁波))
;
Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学系)
;
Munich Center for Machine Learning, LMU Munich(慕尼黑大学机器学习慕尼黑中心)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Locality-Aware Redundancy Pruning for LLM Depth Compression
面向LLM深度压缩的局部感知冗余剪枝
Vincent-Daniel Yun, Youngrae Kim, Woosang Lim, YoungJin Heo, Minkyu Kim, Sunwoo Lee
机构
*
University of Southern California(美国南加州大学)
;
Neural Superintelligence Lab, MODULABS(MODULABS神经超级智能实验室)
;
Seoul National University(首尔国立大学)
;
Inha University(釜山大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
SigmaScale: LLM Compression with SVD-based Low-Rank Decomposition and Learned Scaling Matrices
SigmaScale: 基于SVD低秩分解和学习缩放矩阵的LLM压缩
Ernests Lavrinovics, Marco Letizia, Roy Janco, Shai Segal, Johannes Bjerva, Maurizio Pierini
机构
*
Department of Computer Science, Aalborg University Copenhagen(奥尔堡大学哥本哈根分校计算机科学系)
;
MaLGa-DIBRIS, University of Genoa(热那亚大学MaLGa-DIBRIS)
;
INFN, Sezione di Genova(国家核物理研究所热那亚分部)
;
European Organization for Nuclear Research (CERN)(欧洲核子研究中心)
;
Ceva, Inc.(Ceva公司)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Mass-Scale Analysis of In-the-Wild Conversations Reveals Complexity Bounds on LLM Jailbreaking
大规模真实对话分析揭示LLM越狱的复杂性界限
Aldan Creo, Raul Castro Fernandez, Manuel Cebrian
机构
*
Valencian Research Institute for Artificial Intelligence (VRAIN), Universitat Politècnica de València, Valencia, Spain.(瓦伦西亚人工智能研究 institute,瓦伦西亚理工大学,西班牙瓦伦西亚)
;
Department of Computer Science, The University of Chicago, Chicago, USA(计算机科学系,芝加哥大学,美国芝加哥)
;
Center for Automation and Robotics, Spanish National Research Council, Madrid, Spain(自动化与机器人中心,西班牙国家研究委员会,西班牙马德里)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning
自信号驱动的多LLM辩论以实现高效准确的推理
Xuhang Chen, Zhifan Song, Deyi Ji, Shuo Gao, Lanyun Zhu
机构
*
University of Cambridge(剑桥大学)
;
Sorbonne Université(索邦大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Beihang University(北航大学)
;
Nanyang Technological University(南洋理工大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Skill Weaving: Efficient LLM Improvement via Modular Skillpacks
技能编织:通过模块化技能包实现高效的LLM改进
Zhuo Li, Guodong Du, Zesheng Shi, Weiyang Guo, Weijun Yao, Yuan Zhou, Jiabo Zhang, Jing Li
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
The Hong Kong Polytechnic University(香港理工大学)
;
Huawei Technologies Co., Ltd.(华为技术有限公司)
;
Shanghai Jiaotong University(上海交通大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
LABO: LLM-Accelerated Bayesian Optimization through Broad Exploration and Selective Experimentation
LABO: 通过广泛探索和选择性实验实现的LLM加速贝叶斯优化
Zhuo Chen, Xinzhe Yuan, Jianshu Zhang, Jinzong Dong, Ruichen Zhou, Yingchun Niu, Tianhang Zhou, Yu Yang Fredrik Liu, Yuqiang Li, Nanyang Ye, Qinying Gu
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)
;
Institute for Advanced Study in Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学研究所)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
School of Automation, Central South University(中南大学自动化学院)
;
College of New Energy and Materials, China University of Petroleum, Beijing(中国石油大学(北京)新能源与材料学院)
;
College of Carbon Neutrality Future Technology, China University of Petroleum, Beijing(中国石油大学(北京)碳中和未来技术学院)
;
DeepVerse PTE. LTD.
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
机构
*
Department of Electrical Engineering and Computer Science, York University(约克大学电气工程与计算机科学系)
;
Samsung Research America(三星美国研究院)
;
Department of Software and IT Engineering, École de technologie supérieure (ÉTS), University of Quebec(魁北克大学软件与信息技术工程系,École de technologie supérieure)
;
Non-Terrestrial Networks (Carleton-NTN) Lab and the Department of Systems and Computer Engineering, Carleton University(非地面网络(Carleton-NTN)实验室和系统与计算机工程系,卡尔顿大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG