arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-11 至 2025-11-11 共收录 64 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 64 篇

2406.12403 2025-11-11 cs.CL cs.AI 91%

FedCoT: Federated Chain-of-Thought Distillation for Large Language Models

Tao Fan, Weijing Chen, Yan Kang, Guoqiang Ma, Hanlin Gu, Yuanfeng Song, Lixin Fan, Qiang Yang

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) WeBank Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15857 2025-11-11 cs.CL cs.AI cs.LG 91%

PPC-GPT: Federated Task-Specific Compression of Large Language Models via Pruning and Chain-of-Thought Distillation

Tao Fan, Guoqiang Ma, Yuanfeng Song, Lixin Fan, Qiang Yang

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) WeBank Co., Ltd(WeBank公司) Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16002 2025-11-11 cs.CL 89%

KVLink: Accelerating Large Language Models via Efficient KV Cache Reuse

Jingbo Yang, Bairu Hou, Wei Wei, Yujia Bao, Shiyu Chang

机构 * Department of Computer Science UC Santa Barbara(计算机科学系 UC 圣塔芭芭拉大学) Center for Advanced AI Accenture(先进人工智能中心 江苏 Accenture)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00457 2025-11-11 cs.AI 89%

GraphChain: Large Language Models for Large-scale Graph Analysis via Tool Chaining

Chunyu Wei, Wenji Hu, Xingjia Hao, Xin Wang, Yifan Yang, Yueguo Chen, Yang Tian, Yunhai Wang

机构 * Renmin University of China(中国人民大学) Guangxi University(广西大学) Beijing Jiaotong University(北京交通大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09091 2025-11-11 cs.CL 89%

Utilizing Multilingual Encoders to Improve Large Language Models for Low-Resource Languages

Imalsha Puranegedara, Themira Chathumina, Nisal Ranathunga, Nisansa de Silva, Surangika Ranathunga, Mokanarangan Thayaparan

机构 * School of Mathematical and Computational Sciences, Massey University, Auckland, New Zealand(数学与计算科学学院,梅西大学,奥克兰,新西兰) Department of Computer Science, The Open University, Milton Keynes, United Kingdom(计算机科学系,开放大学,米利顿凯斯,英国)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16309 2025-11-11 physics.med-ph cs.AI 89%

Evaluating The Performance of Using Large Language Models to Automate Summarization of CT Simulation Orders in Radiation Oncology

Meiyun Cao, Shaw Hu, Jason Sharp, Edward Clouser, Jason Holmes, Linda L. Lam, Xiaoning Ding, Diego Santos Toesca, Wendy S. Lindholm, Samir H. Patel, Sujay A. Vora, Peilong Wang, Wei Liu

机构 * Department of Radiation Oncology, Mayo Clinic, Phoenix, AZ 85054(放射肿瘤科,梅奥诊所,凤凰城,AZ 85054)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06086 2025-11-11 cs.CL cs.LG 88%

MuonAll: Muon Variant for Efficient Finetuning of Large Language Models

Saurabh Page, Advait Joshi, S. S. Sonawane

机构 * Computer Engineering(计算机工程) Pune Institute of Computer Technology(普那计算机技术学院)

专题命中 效率与部署 :language model(title,abstract);large language model(title);pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06979 2025-11-11 cs.LG cs.GT 88%

Breaking the Gradient Barrier: Unveiling Large Language Models for Strategic Classification

Xinpeng Lv, Yunxin Mao, Haoxuan Li, Ke Liang, Jinxuan Yang, Wanrong Huang, Haoang Chi, Huan Chen, Long Lan, Yuanlong Chen, Wenjing Yang, Haotian Wang

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) Center for Data Science, Peking University(北京大学数据科学中心) Faculty of Engineering, the University of Sydney(悉尼大学工程学院) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06512 2025-11-11 cs.CR cs.LG 88%

EASE: Practical and Efficient Safety Alignment for Small Language Models

Haonan Shi, Guoli Wang, Tu Ouyang, An Wang

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);分类 cs.LG

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15052 2025-11-11 cs.AI 88%

GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization

Zihui Wu, Haichang Gao, Ping Wang, Shudong Zhang, Zhaoxiang Liu, Shiguo Lian

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16328 2025-11-11 q-bio.TO cs.CL eess.IV physics.med-ph 88%

The Role of High-Performance GPU Resources in Large Language Model Based Radiology Imaging Diagnosis

Jyun-Ping Kao

机构 * Graduate Institute of Biomedical Electronics and Bioinformatics(生物医学电子与生物信息学研究生院) National Taiwan University(台湾大学)

专题命中 效率与部署 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01717 2025-11-11 cs.LG 88%

Choose Your Model Size: Any Compression of Large Language Models Without Re-Computation

Martin Genzel, Patrick Putzky, Pengfei Zhao, Sebastian Schulze, Mattes Mollenhauer, Robert Seidel, Stefan Dietzel, Thomas Wollmann

机构 * Merantix Momentum(梅兰特克斯动力)

专题命中 效率与部署 :large language model(title);language model(title);foundation model(abstract);post-training(abstract)

Comments Code available under https://github.com/merantix-momentum/acip

Journal ref Transactions on Machine Learning Research, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12658 2025-11-11 cs.DC 88%

HydraInfer: Hybrid Disaggregated Scheduling for Multimodal Large Language Model Serving

Xianzhe Dong, Tongxuan Liu, Yuting Zeng, Liangyu Liu, Yang Liu, Siyu Wu, Yu Wu, Hailong Yang, Ke Zhang, Jing Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06430 2025-11-11 cs.LG cs.CL 87%

CG-TTRL: Context-Guided Test-Time Reinforcement Learning for On-Device Large Language Models

Peyman Hosseini, Ondrej Bohdal, Taha Ceritli, Ignacio Castro, Matthew Purver, Mete Ozay, Umberto Michieli

机构 * Samsung R&D Institute UK(三星研发院英国分院) Queen Mary University of London(伦敦大学女王学院)

专题命中 效率与部署 :large language model(title);language model(title);foundation model(abstract);分类 cs.CL、cs.LG

Comments 12 pages, 7 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06010 2025-11-11 cs.LG cs.AI cs.DC 86%

MoSKA: Mixture of Shared KV Attention for Efficient Long-Sequence LLM Inference

Myunghyun Rhee, Sookyung Choi, Euiseok Kim, Joonseop Sim, Youngpyo Joo, Hoshik Kim

机构 * SK hynix Inc.(SK 海力士公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 4 pages, 5 figures, accepted for publication at IEEE Computer Architecture Letters (IEEE CAL), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06319 2025-11-11 cs.LG cs.AI 86%

Accelerating LLM Inference Throughput via Asynchronous KV Cache Prefetching

Yanhao Dong, Yubo Miao, Weinan Li, Xiao Zheng, Chao Wang, Jiesheng Wu, Feng Lyu

机构 * AAAI(美国人工智能协会) AAAI Press Staff(AAAI出版社员工) AAAI Publications Committee(AAAI出版委员会)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08736 2025-11-11 cs.LG 85%

ChemBOMAS: Accelerated BO in Chemistry with LLM-Enhanced Multi-Agent System

Dong Han, Zhehong Ai, Pengxiang Cai, Shanya Lu, Jianpeng Chen, Zihao Ye, Shuzhou Sun, Ben Gao, Lingli Ge, Weida Wang, Xiangxin Zhou, Xihui Liu, Mao Su, Wanli Ouyang, Lei Bai, Dongzhan Zhou, Tao Xu, Yuqiang Li, Shufei Zhang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tongji University(同济大学) The University of Hong Kong(香港大学) Fudan University(复旦大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13949 2025-11-11 cs.CL 85%

Mufu: Multilingual Fused Learning for Low-Resource Translation with LLM

Zheng Wei Lim, Nitish Gupta, Honglin Yu, Trevor Cohn

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06262 2025-11-11 cs.AI cs.CY 85%

GAIA: A General Agency Interaction Architecture for LLM-Human B2B Negotiation & Screening

Siming Zhao, Qi Li

机构 * Alibaba.com US E-Commerce(阿里巴巴美国电子商务) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05502 2025-11-11 cs.AR cs.AI 85%

Production-Grade Local LLM Inference on Apple Silicon: A Comparative Study of MLX, MLC-LLM, Ollama, llama.cpp, and PyTorch MPS

Varun Rajesh, Om Jodhpurkar, Pooja Anbuselvan, Mantinder Singh, Ashok Jallepali, Shantanu Godbole, Pradeep Kumar Sharma, Hritvik Shrivastava

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07049 2025-11-11 cs.CV cs.CR 85%

From Pretrain to Pain: Adversarial Vulnerability of Video Foundation Models Without Task Knowledge

Hui Lu, Yi Yu, Song Xia, Yiming Yang, Deepu Rajan, Boon Poh Ng, Alex Kot, Xudong Jiang

专题命中 效率与部署 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments AAAI 2026 (Oral presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07035 2025-11-11 cs.OS 85%

GoCkpt: Gradient-Assisted Multi-Step overlapped Checkpointing for Efficient LLM Training

Keyao Zhang, Yiquan Chen, Zhuo Hu, Wenhai Lin, Jiexiong Xu, Wenzhi Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 12 pages, 10 figures, 1 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10225 2025-11-11 cs.AR 85%

ISAAC: Intelligent, Scalable, Agile, and Accelerated CPU Verification via LLM-aided FPGA Parallelism

Jialin Sun, Yuchen Hu, Dean You, Yushu Du, Hui Wang, Xinwei Fang, Weiwei Shan, Nan Guan, Zhe Jiang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments require revision, update later

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06776 2025-11-11 cs.LG cs.AI 84%

Data Trajectory Alignment for LLM Domain Adaptation: A Two-Phase Synthesis Framework for Telecommunications Mathematics

Zhicheng Zhou, Jing Li, Suming Qiu, Junjie Huang, Linyuan Qiu, Zhijie Sun

机构 * Global Technical Service (GTS) Huawei Technologies Co., Ltd(华为技术有限公司全球技术服务部)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05597 2025-11-11 cs.AI cs.LG 84%

From Prompts to Power: Measuring the Energy Footprint of LLM Inference

Francisco Caravaca, Ángel Cuevas, Rubén Cuevas

机构 * UC3M-Santander Big Data Institute(UC3M-桑坦德大数据研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06288 2025-11-11 cs.SD cs.CL cs.MM eess.AS 83%

ELEGANCE: Efficient LLM Guidance for Audio-Visual Target Speech Extraction

Wenxuan Wu, Shuai Wang, Xixin Wu, Helen Meng, Haizhou Li

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07171 2025-11-11 cs.CV cs.AI cs.LG 81%

Federated Learning for Video Violence Detection: Complementary Roles of Lightweight CNNs and Vision-Language Models for Energy-Efficient Use

Sébastien Thuau, Siba Haidar, Rachid Chelouah

机构 * esieaLab, ETIS Laboratory(esiea实验室,ETIS实验室) ESIEA, University of CY Cergy(ESIEA,CY塞克大学) ETIS Laboratory, CNR1S, UMR8051(ETIS实验室,CNR1S,UMR8051)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

Comments 5 pages, 3 figures, ICTAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05560 2025-11-11 cs.CL cs.AI 81%

Sample-Efficient Language Modeling with Linear Attention and Lightweight Enhancements

Patrick Haller, Jonas Golde, Alan Akbik

机构 * Humboldt-Universität zu Berlin(洪堡大学柏林分校)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the First BabyLM Workshop 2025, pages 175 to 191, Suzhou, China. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07229 2025-11-11 cs.DC cs.AI 79%

LLMServingSim2.0: A Unified Simulator for Heterogeneous Hardware and Serving Techniques in LLM Infrastructure

Jaehong Cho, Hyunmin Choi, Jongse Park

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments 4 pages, 3 figures

Journal ref IEEE Computer Architecture Letters (CAL) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18480 2025-11-11 cs.CL 79%

How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices

Han Peng, Peiyu Liu, Zican Dong, Daixuan Cheng, Junyi Li, Yiru Tang, Shuo Wang, Wayne Xin Zhao

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) University of International Business and Economics(国际商务经济大学) Tsinghua University(清华大学) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏