arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2409.01483 2024-09-04 cs.LG cs.CL 86%

Revisiting SMoE Language Models by Evaluating Inefficiencies with Task Specific Expert Pruning

Soumajyoti Sarkar, Leonard Lausen, Volkan Cevher, Sheng Zha, Thomas Brox, George Karypis

专题命中 效率与部署 :language model(title,abstract);pretraining(abstract);post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10774 2024-08-28 cs.CL cs.LG 86%

Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference

Jiaming Tang, Yilong Zhao, Kan Zhu, Guangxuan Xiao, Baris Kasikci, Song Han

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11849 2024-08-23 cs.CL cs.AI eess.AS 86%

Style-Talker: Finetuning Audio Language Model and Style-Based Text-to-Speech Model for Fast Spoken Dialogue Generation

Yinghao Aaron Li, Xilin Jiang, Jordan Darefsky, Ge Zhu, Nima Mesgarani

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments CoLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00952 2024-08-09 cs.CL cs.LG 86%

MediSwift: Efficient Sparse Pre-trained Biomedical Language Models

Vithursan Thangarasa, Mahmoud Salem, Shreyas Saxena, Kevin Leong, Joel Hestness, Sean Lie

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 2 Figures, 5 Tables (Main Paper) + 3 pages (Supplementary Material). Published at ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03561 2024-08-08 cs.CR cs.AI cs.LG 86%

MPC-Minimized Secure LLM Inference

Deevashwer Rathee, Dacheng Li, Ion Stoica, Hao Zhang, Raluca Popa

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01935 2024-08-06 cs.CL cs.AI 86%

Defining and Evaluating Decision and Composite Risk in Language Models Applied to Natural Language Inference

Ke Shen, Mayank Kejriwal

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments arXiv admin note: text overlap with arXiv:2310.03283

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01453 2024-08-06 cs.CY cs.AI cs.CL 86%

Reporting and Analysing the Environmental Impact of Language Models on the Example of Commonsense Question Answering with External Knowledge

Aida Usmanova, Junbo Huang, Debayan Banerjee, Ricardo Usbeck

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Presented at Bonn Sustainable AI 2023 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05908 2024-07-30 cs.CL cs.LG 86%

Predictive Pipelined Decoding: A Compute-Latency Trade-off for Exact LLM Decoding

Seongjun Yang, Gibbeum Lee, Jaewoong Cho, Dimitris Papailiopoulos, Kangwook Lee

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ES-FoMo Workshop at ICML 2023 / Published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00317 2024-07-17 cs.LG cs.AI 86%

FlexRound: Learnable Rounding based on Element-wise Division for Post-Training Quantization

Jung Hyun Lee, Jeonghoon Kim, Se Jung Kwon, Dongsoo Lee

专题命中 效率与部署 :post-training(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06645 2024-07-12 cs.LG cs.CL 86%

Entropy Law: The Story Behind Data Compression and LLM Performance

Mingjia Yin, Chuhan Wu, Yufei Wang, Hao Wang, Wei Guo, Yasheng Wang, Yong Liu, Ruiming Tang, Defu Lian, Enhong Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17633 2024-06-26 cs.CL cs.LG 86%

Knowledge Distillation in Automated Annotation: Supervised Text Classification with LLM-Generated Training Labels

Nicholas Pangakis, Samuel Wolken

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments In Proceedings of the Sixth Workshop on Natural Language Processing and Computational Social Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04666 2024-06-26 cs.CL cs.LG 86%

Telecom Language Models: Must They Be Large?

Nicola Piovesan, Antonio De Domenico, Fadhel Ayed

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);small language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03244 2024-06-25 cs.LG cs.CL 86%

Skill Set Optimization: Reinforcing Language Model Behavior via Transferable Skills

Kolby Nottingham, Bodhisattwa Prasad Majumder, Bhavana Dalvi Mishra, Sameer Singh, Peter Clark, Roy Fox

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Proceedings of the 41st International Conference on Machine Learning, Vienna, Austria. PMLR 235, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12604 2024-06-19 cs.CL cs.AI 86%

Tiny Refinements Elicit Resilience: Toward Efficient Prefix-Model Against LLM Red-Teaming

Jiaxu Liu, Xiangyu Yin, Sihao Wu, Jianhong Wang, Meng Fang, Xinping Yi, Xiaowei Huang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint, 10 pages main with 10 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10903 2024-06-18 cs.LG cs.CL cs.SE 86%

New Solutions on LLM Acceleration, Optimization, and Application

Yingbing Huang, Lily Jiaxin Wan, Hanchen Ye, Manvi Jha, Jinghua Wang, Yuhong Li, Xiaofan Zhang, Deming Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments This is an expanded and more comprehensive study based on our invited DAC-24 paper with the same title and co-authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04575 2024-06-18 cs.LG cs.AI math.OC 86%

To Cool or not to Cool? Temperature Network Meets Large Foundation Models via DRO

Zi-Hao Qiu, Siqi Guo, Mao Xu, Tuo Zhao, Lijun Zhang, Tianbao Yang

专题命中 效率与部署 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 41 pages, 10 figures, accepted by ICML2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10774 2024-06-18 cs.LG cs.CL 86%

Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads

Tianle Cai, Yuhong Li, Zhengyang Geng, Hongwu Peng, Jason D. Lee, Deming Chen, Tri Dao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments The code for this implementation is available at https://github.com/FasterDecoding/Medusa

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08607 2024-06-14 cs.CL cs.AI 86%

Reversing the Forget-Retain Objectives: An Efficient LLM Unlearning Framework from Logit Difference

Jiabao Ji, Yujian Liu, Yang Zhang, Gaowen Liu, Ramana Rao Kompella, Sijia Liu, Shiyu Chang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03746 2024-06-07 cs.CL cs.AI 86%

Efficient Knowledge Infusion via KG-LLM Alignment

Zhouyu Jiang, Ling Zhong, Mengshu Sun, Jun Xu, Rui Sun, Hui Cai, Shuhan Luo, Zhiqiang Zhang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00059 2024-06-06 cs.CL cs.DC cs.LG 86%

Conveyor: Efficient Tool-aware LLM Serving with Tool Partial Execution

Yechen Xu, Xinhao Kong, Tingjun Chen, Danyang Zhuo

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19888 2024-05-31 cs.LG cs.AI 86%

Parrot: Efficient Serving of LLM-based Applications with Semantic Variable

Chaofan Lin, Zhenhua Han, Chengruidong Zhang, Yuqing Yang, Fan Yang, Chen Chen, Lili Qiu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments To appear on USENIX OSDI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17755 2024-05-29 cs.CL cs.AI 86%

XL3M: A Training-free Framework for LLM Length Extension Based on Segment-wise Inference

Shengnan Wang, Youhui Bai, Lin Zhang, Pingyi Zhou, Shixiong Zhao, Gong Zhang, Sen Wang, Renhai Chen, Hua Xu, Hongwei Sun

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11592 2024-05-29 cs.LG cs.CL 86%

Revisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark

Yihua Zhang, Pingzhi Li, Junyuan Hong, Jiaxiang Li, Yimeng Zhang, Wenqing Zheng, Pin-Yu Chen, Jason D. Lee, Wotao Yin, Mingyi Hong, Zhangyang Wang, Sijia Liu, Tianlong Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05329 2024-05-15 cs.DC cs.AI cs.CL 86%

KV-Runahead: Scalable Causal LLM Inference by Parallel Key-Value Cache Generation

Minsik Cho, Mohammad Rastegari, Devang Naik

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments preprint for ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03594 2024-05-07 cs.CL cs.AI 86%

Enabling High-Sparsity Foundational Llama Models with Efficient Pretraining and Deployment

Abhinav Agarwalla, Abhay Gupta, Alexandre Marques, Shubhra Pandit, Michael Goin, Eldar Kurtic, Kevin Leong, Tuan Nguyen, Mahmoud Salem, Dan Alistarh, Sean Lie, Mark Kurtz

专题命中 效率与部署 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16363 2024-05-03 cs.CL cs.AI 86%

LLM Inference Unveiled: Survey and Roofline Model Insights

Zhihang Yuan, Yuzhang Shang, Yang Zhou, Zhen Dong, Zhe Zhou, Chenhao Xue, Bingzhe Wu, Zhikai Li, Qingyi Gu, Yong Jae Lee, Yan Yan, Beidi Chen, Guangyu Sun, Kurt Keutzer

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15804 2024-04-25 cs.LG cs.AI 86%

GeckOpt: LLM System Efficiency via Intent-Based Tool Selection

Michael Fore, Simranjit Singh, Dimitrios Stamoulis

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments GLSVLSI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13813 2024-04-23 cs.CL cs.AI 86%

From LLM to NMT: Advancing Low-Resource Machine Translation with Claude

Maxim Enis, Mark Hopkins

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01544 2024-04-04 cs.CL cs.LG 86%

Divergent Token Metrics: Measuring degradation to prune away LLM components -- and optimize quantization

Björn Deiseroth, Max Meuer, Nikolas Gritsch, Constantin Eichenberg, Patrick Schramowski, Matthias Aßenmacher, Kristian Kersting

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19802 2024-04-01 cs.CL cs.AI 86%

Developing Healthcare Language Model Embedding Spaces

Niall Taylor, Dan Schofield, Andrey Kormilitzin, Dan W Joyce, Alejo Nevado-Holgado

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏