arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2511.22138 2025-12-01 cs.LG 90%

TinyLLM: Evaluation and Optimization of Small Language Models for Agentic Tasks on Edge Devices

TinyLLM: 小型语言模型在边缘设备上用于代理任务的评估与优化

Mohd Ariful Haque, Fahad Rahman, Kishor Datta Gupta, Khalil Shujaee, Roy George

机构 * Department of Cyber-Physical Systems, Clark Atlanta University, USA(计算机物理系统系,Clark Atlanta大学,美国) Department of Computer Science and Engineering, United International University, Bangladesh(计算机科学与工程系,联合国际大学,孟加拉国)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);SFT(abstract);preference optimization(abstract)

AI总结 TinyLLM研究小型语言模型在边缘设备上执行代理任务的优化方法,通过混合策略提升准确性与效率,验证了中等规模模型在多轮任务中的优势。

Comments 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15434 2025-11-20 cs.CR cs.AI 90%

Small Language Models for Phishing Website Detection: Cost, Performance, and Privacy Trade-Offs

小型语言模型在钓鱼网站检测中的应用:成本、性能与隐私的权衡

Georg Goldenits, Philip Koenig, Sebastian Raubitzek, Andreas Ekelhart

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 本文研究了小型语言模型在钓鱼网站检测中的应用,探讨了其在成本、性能和隐私方面的权衡,展示了SLMs在替代外部LLM服务方面的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19134 2025-11-20 cs.CR cs.CL 90%

Confidential Prompting: Privacy-preserving LLM Inference on Cloud

Caihua Li, In Gim, Lin Zhong

机构 * Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13476 2025-11-18 cs.AI 90%

Multi-Agent Multimodal Large Language Model Framework for Automated Interpretation of Fuel Efficiency Analytics in Public Transportation

Zhipeng Ma, Ali Rida Bahja, Andreas Burgdorf, André Pomp, Tobias Meisen, Bo Nørregaard Jørgensen, Zheng Grace Ma

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref Applied Sciences, 2025, 15(21), 11619

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03830 2025-11-07 cs.CL 90%

Divide, Cache, Conquer: Dichotomic Prompting for Efficient Multi-Label LLM-Based Classification

Mikołaj Langner, Jan Eliasz, Ewa Rudnicka, Jan Kocoń

机构 * Department of Artificial Intelligence, Wroclaw Tech, Poland(人工智能系,沃拉布勒技术学院,波兰)

专题命中 效率与部署 :LLM(title,abstract);prompting(title);large language model(abstract);language model(abstract)

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04405 2025-11-04 cs.LG 90%

FlexQ: Efficient Post-training INT6 Quantization for LLM Serving via Algorithm-System Co-Design

Hao Zhang, Aining Jia, Weifeng Bu, Yushu Cai, Kai Sheng, Hao Chen, Xin He

专题命中 效率与部署 :LLM(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25817 2025-10-31 cs.CL 90%

A Survey on Efficient Large Language Model Training: From Data-centric Perspectives

Junyu Luo, Bohan Wu, Xiao Luo, Zhiping Xiao, Yiqiao Jin, Rong-Cheng Tu, Nan Yin, Yifan Wang, Jingyang Yuan, Wei Ju, Ming Zhang

机构 * State Key Laboratory for Multimedia Information Processing, School of Computer Science, PKU-Anker LLM Lab, Peking University(信息处理国家重点实验室,计算机学院,PKU-Anker LLM实验室,北京大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Washington(华盛顿大学) Georgia Institute of Technology(佐治亚理工学院) Nanyang Technological University(南洋理工大学) HKUST(香港科技大学) University of International Business and Economics(国际商务经济大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22101 2025-10-28 cs.IR cs.LG 90%

Scaling Up Efficient Small Language Models Serving and Deployment for Semantic Job Search

Kayhan Behdin, Qingquan Song, Sriram Vasudevan, Jian Sheng, Xiaojing Ma, Z Zhou, Chuanrui Zhu, Guoyao Li, Chanh Nguyen, Sayan Ghosh, Hejian Sang, Ata Fatahi Baarzi, Sundara Raman Ramachandran, Xiaoqing Wang, Qing Lan, Vinay Y S, Qi Guo, Caleb Johnson, Zhipeng Wang, Fedor Borisyuk

机构 * Anonymous Authors(匿名作者)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05943 2025-10-08 cs.DC cs.LG 90%

EARL: Efficient Agentic Reinforcement Learning Systems for Large Language Models

Zheyue Tan, Mustapha Abdullahi, Tuo Shi, Huining Yuan, Zelai Xu, Chao Yu, Boxun Li, Bo Zhao

机构 * Aalto University(阿alto大学) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25622 2025-10-07 cs.LG 90%

Layer-wise dynamic rank for compressing large language models

Zhendong Mi, Bian Sun, Grace Li Zhang, Shaoyi Huang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) Carnegie Mellon University(卡内基梅隆大学) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03353 2025-08-11 cs.CL 90%

Towards Pareto Optimal Throughput in Small Language Model Serving

Pol G. Recasens, Yue Zhu, Chen Wang, Eun Kyung Lee, Olivier Tardieu, Alaa Youssef, Jordi Torres, Josep Ll. Berral

机构 * Barcelona Supercomputing Center(巴塞罗那超级计算中心) IBM Research(IBM研究院)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

Comments Revised version of the paper published at EuroMLSys'24, fix figure 6 and 7

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02668 2025-08-05 cs.LG 90%

LOST: Low-rank and Sparse Pre-training for Large Language Models

Jiaxi Li, Lu Yin, Li Shen, Jinjin Xu, Liwu Xu, Tianjin Huang, Wenwu Wang, Shiwei Liu, Xilu Wang

机构 * University of Surrey(塞维利亚大学) University of Oxford(牛津大学) Sun Yat-sen University(中山大学) Bytedance(字节跳动) Alibaba Group(阿里巴巴集团) University of Exeter(埃克塞特大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09329 2025-06-12 cs.CL 90%

Towards Efficient and Effective Alignment of Large Language Models

Yuxin Jiang

机构 * Division of Emerging Interdisciplinary Areas(新兴跨学科领域 division)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14055 2025-05-28 cs.CL 90%

DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization

Hexuan Deng, Wenxiang Jiao, Xuebo Liu, Jing Li, Min Zhang, Zhaopeng Tu

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能研究院,哈尔滨工业大学深圳校区)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);pretraining(abstract)

Comments Accepted by ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10735 2025-05-26 cs.CL 90%

Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models

Shuqi Liu, Bowei He, Han Wu, Linqi Song

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14915 2025-04-22 eess.AS cs.AI 90%

StableQuant: Layer Adaptive Post-Training Quantization for Speech Foundation Models

Yeona Hong, Hyewon Han, Woo-jin Chung, Hong-Goo Kang

机构 * Department of Electrical and Electronic Engineering, Yonsei University(电子工程系,延世大学)

专题命中 效率与部署 :foundation model(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05852 2025-04-10 cs.SE cs.AI 90%

Evaluating Large Language Models in Code Generation: INFINITE Methodology for Defining the Inference Index

Nicholas Christakis, Dimitris Drikakis

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 20 pages, 6 figures

Journal ref Appl. Sci. 2025, 15, 3784

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17101 2025-03-24 cs.LG 90%

Large Language Model Compression via the Nested Activation-Aware Decomposition

Jun Lu, Tianyi Xu, Bill Ding, David Li, Yu Kang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14130 2025-03-19 cs.AI cs.SE 90%

Inference-Time Intervention in Large Language Models for Reliable Requirement Verification

Paul Darm, James Xie, Annalisa Riccardi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10881 2025-03-17 cs.CL 90%

SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable

Jiaxin Zhang, Zhuohang Li, Wendi Cui, Kamalika Das, Bradley malin, Sricharan Kumar

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04347 2025-03-07 cs.LG q-bio.GN 90%

Large Language Models for Zero-shot Inference of Causal Structures in Biology

Izzy Newsham, Luka Kovačević, Richard Moulange, Nan Rosemary Ke, Sach Mukherjee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments ICLR 2025 Workshop on Machine Learning for Genomics Explorations

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18125 2025-03-07 cs.DC cs.AI cs.NI 90%

Towards Edge General Intelligence via Large Language Models: Opportunities and Challenges

Handi Chen, Weipeng Deng, Shuo Yang, Jinfeng Xu, Zhihan Jiang, Edith C. H. Ngai, Jiangchuan Liu, Xue Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17927 2025-03-06 cs.CL 90%

Advantage-Guided Distillation for Preference Alignment in Small Language Models

Shiping Gao, Fanqi Wan, Jiajian Guo, Xiaojun Quan, Qifan Wang

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

Comments Accepted by ICLR 2025(spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00686 2025-03-04 cs.SE cs.AI 90%

GPIoT: Tailoring Small Language Models for IoT Program Synthesis and Development

Leming Shen, Qiang Yang, Xinyu Huang, Zijing Ma, Yuanqing Zheng

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14816 2025-02-21 cs.LG 90%

Dynamic Low-Rank Sparse Adaptation for Large Language Models

Weizhong Huang, Yuxin Zhang, Xiawu Zheng, Yang Liu, Jing Lin, Yiwu Yao, Rongrong Ji

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13725 2025-02-20 cs.CL 90%

Adapting Large Language Models for Time Series Modeling via a Novel Parameter-efficient Adaptation Method

Juyuan Zhang, Wei Zhu, Jiechao Gao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08350 2024-12-16 cs.CL 90%

Salute the Classic: Revisiting Challenges of Machine Translation in the Age of Large Language Models

Jianhui Pang, Fanghua Ye, Longyue Wang, Dian Yu, Derek F. Wong, Shuming Shi, Zhaopeng Tu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments This paper has been accepted by TACL; A pre-MIT Press publication version; Longyue Wang is the Corresponding Author

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06282 2024-12-13 cs.LG 90%

PowerInfer-2: Fast Large Language Model Inference on a Smartphone

Zhenliang Xue, Yixin Song, Zeyu Mi, Xinrui Zheng, Yubin Xia, Haibo Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02451 2024-11-25 cs.CL cs.DL cs.IR 90%

High-performance automated abstract screening with large language model ensembles

Rohan Sanghera, Arun James Thirunavukarasu, Marc El Khoury, Jessica O'Logbon, Yuqing Chen, Archie Watt, Mustafa Mahmood, Hamid Butt, George Nishimura, Andrew Soltan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments RS and AJT are joint-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19103 2024-10-28 cs.LG 90%

TesseraQ: Ultra Low-Bit LLM Post-Training Quantization with Block Reconstruction

Yuhang Li, Priyadarshini Panda

专题命中 效率与部署 :LLM(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏