arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2510.00028 2025-10-02 cs.LG cs.AI 88%

Rethinking RoPE Scaling in Quantized LLM: Theory, Outlier, and Channel-Band Analysis with Weight Rescaling

Ye Qiao, Haocheng Xu, Xiaofan Zhang, Sitao Huang

机构 * Department of EECS, University of California, Irvine, USA(加州大学尔湾分校电子工程与计算机科学系) Google(谷歌)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17513 2025-08-29 cs.LG cs.AI cs.AR 88%

Improving Quantization with Post-Training Model Expansion

Giuseppe Franco, Pablo Monteagudo-Lago, Ian Colbert, Nicholas Fraser, Michaela Blott

机构 * AMD

专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16712 2025-08-26 cs.PF cs.AI cs.AR cs.DC cs.LG 88%

Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective

Tianyao Shi, Yi Ding

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 14 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13167 2025-08-20 cs.AI cs.CL 88%

Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL

Weizhen Li, Jianbo Lin, Zhuosong Jiang, Jingyi Cao, Xinpeng Liu, Jiayu Zhang, Zhenqiang Huang, Qianben Chen, Weichen Sun, Qiexiang Wang, Hongxuan Lu, Tianrui Qin, Chenghao Zhu, Yi Yao, Shuying Fan, Xiaowan Li, Tiannan Wang, Pai Liu, King Zhu, He Zhu, Dingfeng Shi, Piaohong Wang, Yeyi Guan, Xiangru Tang, Minghao Liu, Yuchen Eleanor Jiang, Jian Yang, Jiaheng Liu, Ge Zhang, Wangchunshu Zhou

专题命中 效率与部署 :foundation model(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 51 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00370 2025-08-07 cs.CL cs.LG 88%

EdgeInfinite-Instruct: Bridging SFT-Based Optimization and NPU-Level Efficiency for Edge Devices

Jiyu Chen, Poh Seng Lim, Shuang Peng, Daxiong Luo, JungHau Foo, Yap Deep, Timothy Lee Jun Jie, Kelvin Teh Kae Wen, Fan Yang, Danyu Feng, Hao-Yun Chen, Peng-Wen Chen, Fangyuan Li, Xiaoxin Chen, Wong Wai Mun

专题命中 效率与部署 :SFT(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments The data and method in the paper need to be re-audited

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13109 2025-06-17 cs.CL cs.AI 88%

Leveraging In-Context Learning for Language Model Agents

Shivanshu Gupta, Sameer Singh, Ashish Sabharwal, Tushar Khot, Ben Bogin

机构 * University of California Irvine(加州大学伊文斯分校) Allen Institute for AI(人工智能研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04174 2025-05-21 cs.LG cs.AI cs.NI eess.SP 88%

On-Device LLM for Context-Aware Wi-Fi Roaming

Ju-Hyung Lee, Yanqing Lu, Klaus Doppler

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15982 2025-05-13 cs.AR cs.AI cs.LG 88%

Anda: Unlocking Efficient LLM Inference with a Variable-Length Grouped Activation Data Format

Chao Fang, Man Shi, Robin Geens, Arne Symons, Zhongfeng Wang, Marian Verhelst

机构 * School of Electronic Science and Engineering, Nanjing University, China(南京大学电子科学与技术学院) ESAT-MICAS, KU Leuven, Belgium(KU莱顿大学ESAT-MICAS)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments To appear in 2025 IEEE International Symposium on High-Performance Computer Architecture (HPCA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09013 2025-04-29 cs.AI cs.CL 88%

AI-LieDar: Examine the Trade-off Between Utility and Truthfulness in LLM Agents

Zhe Su, Xuhui Zhou, Sanketh Rangreji, Anubha Kabra, Julia Mendelsohn, Faeze Brahman, Maarten Sap

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) Allen Institute for AI(人工智能阿伦研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);language agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14365 2025-04-22 cs.LG cs.AI cs.AR 88%

Accelerating LLM Inference with Flexible N:M Sparsity via A Fully Digital Compute-in-Memory Accelerator

Akshat Ramachandran, Souvik Kundu, Arnab Raha, Shamik Kundu, Deepak K. Mathaikutty, Tushar Krishna

机构 * Georgia Institute of Technology(佐治亚理工学院) Intel Labs(英特尔实验室) Intel Corporation(英特尔公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10877 2025-03-07 cs.CL cs.AI 88%

Improving Data Efficiency via Curating LLM-Driven Rating Systems

Jinlong Pang, Jiaheng Wei, Ankit Parag Shah, Zhaowei Zhu, Yaxuan Wang, Chen Qian, Yang Liu, Yujia Bao, Wei Wei

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08115 2025-02-19 cs.CL cs.AI 88%

Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System

Weize Chen, Jiarui Yuan, Chen Qian, Cheng Yang, Zhiyuan Liu, Maosong Sun

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11895 2025-02-18 cs.LG cs.AI 88%

Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?

Jacob Nielsen, Peter Schneider-Kamp, Lukas Galke

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04392 2025-02-10 cs.CL cs.AI 88%

Division-of-Thoughts: Harnessing Hybrid Language Model Synergy for Efficient On-Device Agents

Chenyang Shao, Xinyuan Hu, Yutang Lin, Fengli Xu

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15255 2025-01-28 cs.LG cs.AI 88%

Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models

Zihuai Xu, Yang Xu, Hongli Xu, Yunming Liao, Zhiwei Yao, Zuan Xie

专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10425 2025-01-13 cs.CL cs.AI 88%

Active Inference for Self-Organizing Multi-LLM Systems: A Bayesian Thermodynamic Approach to Adaptation

Rithvik Prakki

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);language agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03578 2024-12-06 cs.SE cs.AI cs.CL cs.PL 88%

PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback

Yun Peng, Akhilesh Deepak Gotmare, Michael Lyu, Caiming Xiong, Silvio Savarese, Doyen Sahoo

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01093 2024-11-01 cs.LG cs.CL 88%

Need a Small Specialized Language Model? Plan Early!

David Grangier, Angelos Katharopoulos, Pierre Ablin, Awni Hannun

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);small language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15353 2024-09-25 eess.AS cs.CL cs.LG cs.SD 88%

Contextualization of ASR with LLM using phonetic retrieval-based augmentation

Zhihong Lei, Xingyu Na, Mingbin Xu, Ernest Pusateri, Christophe Van Gysel, Yuanyuan Zhang, Shiyi Han, Zhen Huang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11609 2024-08-26 cs.CL cs.AI 88%

Xinyu: An Efficient LLM-based System for Commentary Generation

Yiquan Wu, Bo Tang, Chenyang Xi, Yu Yu, Pengyu Wang, Yifei Liu, Kun Kuang, Haiying Deng, Zhiyu Li, Feiyu Xiong, Jie Hu, Peng Cheng, Zhonghao Wang, Yi Wang, Yi Luo, Mingchuan Yang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06610 2024-08-14 cs.CV cs.CL cs.LG 88%

CROME: Cross-Modal Adapters for Efficient Multimodal LLM

Sayna Ebrahimi, Sercan O. Arik, Tejas Nama, Tomas Pfister

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10582 2024-07-16 cs.CL cs.AI 88%

Boosting Zero-Shot Crosslingual Performance using LLM-Based Augmentations with Effective Data Selection

Barah Fazili, Ashish Sunil Agrawal, Preethi Jyothi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted in Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.17382 2024-07-02 cs.AI cs.LG 88%

Reason for Future, Act for Now: A Principled Framework for Autonomous LLM Agents with Provable Sample Efficiency

Zhihan Liu, Hao Hu, Shenao Zhang, Hongyi Guo, Shuqi Ke, Boyi Liu, Zhaoran Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted by International Conference on Machine Learning (ICML) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17438 2024-05-29 cs.PL cs.AI cs.LG 88%

An LLM-Tool Compiler for Fused Parallel Function Calling

Simranjit Singh, Andreas Karatzas, Michael Fore, Iraklis Anagnostopoulos, Dimitrios Stamoulis

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.12420 2024-05-07 cs.CL cs.AI 88%

LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models

Shizhe Diao, Rui Pan, Hanze Dong, Ka Shun Shum, Jipeng Zhang, Wei Xiong, Tong Zhang

专题命中 效率与部署 :foundation model(title,abstract);language model(abstract);instruction tuning(abstract);pretraining(abstract)

Comments Published in NAACL 2024 Demo Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10105 2024-04-16 cs.CL cs.LG 88%

Understanding Catastrophic Forgetting in Language Models via Implicit Inference

Suhas Kotha, Jacob Mitchell Springer, Aditi Raghunathan

专题命中 效率与部署 :language model(title,abstract);instruction tuning(abstract);pretraining(abstract);prompting(abstract)

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14160 2024-03-06 cs.LG cs.AI 88%

Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement

Wonseok Jeon, Mukul Gagrani, Raghavv Goel, Junyoung Park, Mingu Lee, Christopher Lott

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 82 pages, 9 figures, 54 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01885 2023-12-04 stat.ML cs.CL cs.LG 88%

QuantEase: Optimization-based Quantization for Language Models

Kayhan Behdin, Ayan Acharya, Aman Gupta, Qingquan Song, Siyu Zhu, Sathiya Keerthi, Rahul Mazumder

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);post-training(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11186 2023-10-11 cs.CL cs.LG 88%

Compress, Then Prompt: Improving Accuracy-Efficiency Trade-off of LLM Inference with Transferable Prompt

Zhaozhuo Xu, Zirui Liu, Beidi Chen, Yuxin Tang, Jue Wang, Kaixiong Zhou, Xia Hu, Anshumali Shrivastava

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03078 2023-06-06 cs.CL cs.LG 88%

SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression

Tim Dettmers, Ruslan Svirschevski, Vage Egiazarian, Denis Kuznedelev, Elias Frantar, Saleh Ashkboos, Alexander Borzunov, Torsten Hoefler, Dan Alistarh

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Extended preprint

详情

展开后加载摘要…

URL PDF HTML 收藏