arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-04 至 2025-08-04 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 15 篇

2508.00185 2025-08-04 cs.CL 89%

Comparison of Large Language Models for Deployment Requirements

Alper Yaman, Jannik Schwab, Christof Nitsche, Abhirup Sinha, Marco Huber

机构 * Fraunhofer Institute for Manufacturing Engineering and Automation IPA(弗劳恩霍夫智能制造与自动化研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref Proceedings of the First International Conference on Generative Pre-trained Transformer Models and Beyond (GPTMB 2024), Porto, Portugal, Jun. 2024, pp. 41-44, ISBN: 978-1-68558-182-4

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13205 2025-08-04 quant-ph 89%

Quantum Knowledge Distillation for Large Language Models

Lingxiao Li, Yihao Wang, Jiacheng Fan, Jing Li, Sujuan Qin, Qiaoyan Wen, Fei Gao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02443 2025-08-04 cs.CL 88%

AILS-NTUA at SemEval-2025 Task 4: Parameter-Efficient Unlearning for Large Language Models using Data Chunking

Iraklis Premptis, Maria Lymperaiou, Giorgos Filandrianos, Orfeas Menis Mastromichalakis, Athanasios Voulodimos, Giorgos Stamou

机构 * National Technical University of Athens(希腊国家技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Journal ref The 19th International Workshop on Semantic Evaluation (SemEval 2025) - Best paper award

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21170 2025-08-04 cs.CR cs.AI cs.CL 86%

OneShield -- the Next Generation of LLM Guardrails

Chad DeLuca, Anna Lisa Gentile, Shubhi Asthana, Bing Zhang, Pawan Chowdhary, Kellen Cheng, Basel Shbita, Pengyuan Li, Guang-Jie Ren, Sandeep Gopisetty

机构 * IBM Research(IBM研究院) Princeton University(普林斯顿大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00234 2025-08-04 cs.NI cs.AI cs.DC cs.MA 85%

Quality-of-Service Aware LLM Routing for Edge Computing with Multiple Experts

Jin Yang, Qiong Wu, Zhiying Feng, Zhi Zhou, Deke Guo, Xu Chen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学计算机科学与工程系) College of Systems Engineering, National University of Defense Technology(国防科技大学系统工程学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19693 2025-08-04 cs.CL 85%

AdaptiVocab: Enhancing LLM Efficiency in Focused Domains through Lightweight Vocabulary Adaptation

Itay Nakash, Nitay Calderon, Eyal Ben David, Elad Hoffer, Roi Reichart

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00260 2025-08-04 cs.CV cs.MM 82%

Instruction-Grounded Visual Projectors for Continual Learning of Generative Vision-Language Models

Hyundong Jin, Hyung Jin Chang, Eunwoo Kim

机构 * School of Computer Science and Engineering, Chung-Ang University(Chung-Ang 大学计算机科学与工程学院) School of Computer Science, University of Birmingham(布拉德福德大学计算机科学学院)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00041 2025-08-04 cs.LG cs.AI cs.DC 79%

Learning Like Humans: Resource-Efficient Federated Fine-Tuning through Cognitive Developmental Stages

Yebo Wu, Jingguang Li, Zhijiang Guo, Li Li

机构 * University of Macau(澳门大学) HKUST(香港科技大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13180 2025-08-04 cs.CV 78%

Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration

Mark Endo, Xiaohan Wang, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学)

专题命中 效率与部署 :language model(title,abstract)

Comments ICCV 2025, project page: https://web.stanford.edu/~markendo/projects/feather

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00478 2025-08-04 cs.CR cs.AI 70%

CyGATE: Game-Theoretic Cyber Attack-Defense Engine for Patch Strategy Optimization

Yuning Jiang, Nay Oo, Qiaoran Meng, Lu Lin, Dusit Niyato, Zehui Xiong, Hoon Wei Lim, Biplab Sikdar

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Queen's University Belfast(女王大学贝尔法斯特分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00220 2025-08-04 cs.CL 70%

Semantic Compression for Word and Sentence Embeddings using Discrete Wavelet Transform

Rana Aref Salama, Abdou Youssef, Mona Diab

机构 * School of Engineering and Applied Science, George Washington University(工程与应用科学学院,乔治华盛顿大学) Faculty of Computers and Artificial Intelligence, Cairo University(计算机与人工智能学院,开罗大学) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref https://aclanthology.org/2024.findings-acl.945/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00128 2025-08-04 cs.SE 67%

How Quantization Impacts Privacy Risk on LLMs for Code?

Md Nazmul Haque, Hua Yang, Zhou Yang, Bowen Xu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00324 2025-08-04 cs.AI cs.CL 62%

R1-ACT: Efficient Reasoning Model Safety Alignment by Activating Safety Knowledge

Yeonjun In, Wonjoong Kim, Sangwu Park, Chanyoung Park

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00180 2025-08-04 cs.LG cs.AI stat.ML 62%

EMA Without the Lag: Bias-Corrected Iterate Averaging Schemes

Adam Block, Cyril Zhang

机构 * Columbia University(哥伦比亚大学) Microsoft Research NYC(微软研究院纽约)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00746 2025-08-04 cs.CV 50%

GECO: Geometrically Consistent Embedding with Lightspeed Inference

Regine Hartwig, Dominik Muhle, Riccardo Marin, Daniel Cremers

机构 * TU Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏