arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22280 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22280 篇

2509.25279 2025-10-14 cs.AI cs.DC cs.LG 86%

RL in the Wild: Characterizing RLVR Training in LLM Deployment

Jiecheng Zhou, Qinghao Hu, Yuyang Jin, Zerui Wang, Peng Sun, Yuzhe Gu, Wenwei Zhang, Mingshu Zhai, Xingcheng Zhang, Weiming Zhang

机构 * USTC(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) NTU(国立台湾大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 28 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19274 2025-10-14 cs.LG cs.AI cs.OS cs.PF 86%

Neuralink: Fast LLM Inference on Smartphones with Neuron Co-Activation Linking

Tuowei Wang, Ruwen Fan, Minxing Huang, Zixu Hao, Kun Li, Ting Cao, Youyou Lu, Yaoxue Zhang, Ju Ren

机构 * Tsinghua University(清华大学) Tianjin University(天津大学) Microsoft Research(微软研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the 30th ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Vol. 3, Rotterdam, Netherlands, 2025, pp. 147-162

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09852 2025-10-14 cs.LG cs.AI 86%

ProxRouter: Proximity-Weighted LLM Query Routing for Improved Robustness to Outliers

Shivam Patel, Neharika Jali, Ankur Mallick, Gauri Joshi

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft(微软公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09332 2025-10-13 cs.CL cs.AI 86%

FLRC: Fine-grained Low-Rank Compressor for Efficient LLM Inference

Yu-Chen Lu, Chong-Yan Chen, Chi-Chih Chang, Yu-Fang Hu, Kai-Chiang Wu

机构 * National Yang Ming Chiao Tung University Macronix International Co., Ltd. Cornell University

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08758 2025-10-13 stat.ME cs.CL cs.LG stat.AP 86%

A Design-based Solution for Causal Inference with Text: Can a Language Model Be Too Large?

Graham Tierney, Srikar Katta, Christopher Bail, Sunshine Hillygus, Alexander Volfovsky

机构 * Duke University(杜克大学) Netflix

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08623 2025-10-13 cs.CL cs.LG 86%

PARSE: LLM Driven Schema Optimization for Reliable Entity Extraction

Anubhav Shrimal, Aryan Jain, Soumyajit Chowdhury, Promod Yenigalla

机构 * RBS Tech Sciences, Amazon(RBS科技科学,亚马逊)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17753 2025-10-10 cs.CL cs.AI 86%

Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information

Hojun Cho, Donghu Kim, Soyoung Yang, Chan Lee, Hunjoo Lee, Jaegul Choo

专题命中 效率与部署 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04980 2025-10-07 cs.AI cs.CL 86%

LLM-Hanabi: Evaluating Multi-Agent Gameplays with Theory-of-Mind and Rationale Inference in Imperfect Information Collaboration Game

Fangzhou Liang, Tianshi Zheng, Chunkit Chan, Yauwai Yim, Yangqiu Song

机构 * Department of Computer Science and Engineering, HKUST, Hong Kong SAR, China(计算机科学与工程系,香港科技大学,香港特别行政区,中国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Wordplay

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03275 2025-10-07 cs.LG cs.AI cs.CV 86%

SDQ-LLM: Sigma-Delta Quantization for 1-bit LLMs of any size

Junhao Xia, Ming Zhao, Limin Xiao, Xiujun Zhang

机构 * Dept of Electronic Engineering, Tsinghua University, Beijing, China(电子工程系,清华大学,北京,中国) Beijing National Research Center for Information Science and Technology, Beijing, China(北京信息科学与技术国家研究中心,北京,中国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24436 2025-09-30 cs.LG cs.AI cs.NE 86%

EOE: Evolutionary Optimization of Experts for Training Language Models

Yingshi Chen

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04715 2025-09-30 cs.CL cs.CR cs.LG 86%

Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs

Will Cai, Tianneng Shi, Xuandong Zhao, Dawn Song

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13681 2025-09-29 cs.CL cs.AI 86%

LoopServe: An Adaptive Dual-phase LLM Inference Acceleration System for Multi-Turn Dialogues

Haoyang Li, Zhanchao Xu, Yiming Li, Xuejia Chen, Darian Li, Anxin Tian, Qingfa Xiao, Cheng Deng, Jun Wang, Qing Li, Lei Chen, Mingxuan Yuan

机构 * PolyU HKUST(香港科技大学) HUST(华中科技大学) Huawei Noah’s Ark Lab(华为诺亚实验室) HKUST(GZ)(香港科技大学(广州)) Edin UCL(伦敦大学学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20208 2025-09-25 cs.CL cs.AI cs.DB 86%

Play by the Type Rules: Inferring Constraints for LLM Functions in Declarative Programs

Parker Glenn, Alfy Samuel, Daben Liu

机构 * Capital One

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12044 2025-09-25 cs.LG cs.AI 86%

Why Do Some Inputs Break Low-Bit LLM Quantization?

Ting-Yun Chang, Muru Zhang, Jesse Thomason, Robin Jia

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18362 2025-09-24 cs.LG cs.AI 86%

FastMTP: Accelerating LLM Inference with Enhanced Multi-Token Prediction

Yuxuan Cai, Xiaozhuan Liang, Xinghua Wang, Jin Ma, Haijin Liang, Jinwen Luo, Xinyu Zuo, Lisheng Duan, Yuyang Yin, Xi Chen

机构 * Tencent(腾讯)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15915 2025-09-22 cs.LG cs.AI 86%

Foundation Models as World Models: A Foundational Study in Text-Based GridWorlds

Remo Sasso, Michelangelo Conserva, Dominik Jeurissen, Paulo Rauber

机构 * School of Electronic Engineering and Computer Science(电子工程与计算机科学学院)

专题命中 效率与部署 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 9 figures. Accepted for presentation at the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop on Embodied World Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12886 2025-09-17 cs.CL cs.AI 86%

The LLM Already Knows: Estimating LLM-Perceived Question Difficulty via Hidden Representations

Yubo Zhu, Dongrui Liu, Zecheng Lin, Wei Tong, Sheng Zhong, Jing Shao

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xidian University(西安电子科技大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10753 2025-09-16 cs.LG cs.AI 86%

HalluField: Detecting LLM Hallucinations via Field-Theoretic Modeling

Minh Vu, Brian K. Tran, Syed A. Shah, Geigh Zollicoffer, Nhat Hoang-Xuan, Manish Bhattarai

机构 * Center for Nonlinear Studies(非线性研究中心) Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) T-1 Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室T-1部门) Applied Mathematics University of Colorado Boulder(科罗拉多大学博尔德分校应用数学系) T-4 Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室T-4部门)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04770 2025-09-08 cs.CL cs.LG 86%

Research on Multi-hop Inference Optimization of LLM Based on MQUAKE Framework

Zucheng Liang, Wenxin Wei, Kaijie Zhang, Hongyi Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04474 2025-09-08 cs.CL cs.AI 86%

Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling

Shengyin Sun, Yiming Li, Xing Li, Yingzhao Lian, Weizhe Lin, Hui-Ling Zhen, Zhiyuan Yang, Chen Chen, Xianzhi Yu, Mingxuan Yuan, Chen Ma

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03533 2025-09-05 cs.CL cs.LG q-fin.GN 86%

Topic Identification in LLM Input-Output Pairs through the Lens of Information Bottleneck

Igor Halperin

机构 * Fidelity Investments(fidelity投资公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 26 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14544 2025-09-03 cs.LG cs.AI math.OC 86%

Adaptively Robust LLM Inference Optimization under Prediction Uncertainty

Zixi Chen, Yinyu Ye, Zijie Zhou

机构 * Department of Mathematics, Peking University(北京大学数学系) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系) Department of Industrial Engineering and Decision Analytics, HKUST(香港科技大学工业工程与决策分析系)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19087 2025-09-03 cs.LG cs.AI cs.AR 86%

APT-LLM: Exploiting Arbitrary-Precision Tensor Core Computing for LLM Acceleration

Shaobo Ma, Chao Fang, Haikuo Shao, Zhongfeng Wang

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与技术学院) Shanghai Qi Zhi Institute(上海启智研究院) School of Integrated Circuits, Sun Yat-sen University(中山大学集成电路学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments To appear in the IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems (TCAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00850 2025-08-26 cs.LG cs.AI 86%

ICQuant: Index Coding enables Low-bit LLM Quantization

Xinlin Li, Osama Hanna, Christina Fragouli, Suhas Diggavi

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Meta, GenAI(Meta)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16597 2025-08-26 q-bio.NC cs.AI cs.LG 86%

Bridging Foundation Models and Efficient Architectures: A Modular Brain Imaging Framework with Local Masking and Pretrained Representation Learning

Yanwen Wang, Xinglin Zhao, Yijin Song, Xiaobo Liu, Yanrong Hao, Rui Cao, Xin Wen

机构 * AAAI Press(AAAI 压力)

专题命中 效率与部署 :foundation model(title,abstract);LLM(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15813 2025-08-25 cs.CL cs.AI 86%

SCOPE: A Generative Approach for LLM Prompt Compression

Tinghui Zhang, Yifan Wang, Daisy Zhe Wang

机构 * University of Florida(佛罗里达大学) University of Hawaii - Manoa(夏威夷大学-曼诺亚)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15120 2025-08-22 cs.CL cs.AI 86%

Kuwain 1.5B: An Arabic SLM via Language Injection

Khalil Hennara, Sara Chrouf, Mohamed Motaism Hamed, Zeina Aldallal, Omar Hadid, Safwan AlModhayan

专题命中 效率与部署 :SLM(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11454 2025-08-18 cs.CL cs.AI 86%

Reference Points in LLM Sentiment Analysis: The Role of Structured Context

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN(理化学研究所) AIP(Advanced Institute for Particle Physics)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14910 2025-08-14 cs.CL cs.AI 86%

EvoP: Robust LLM Inference via Evolutionary Pruning

Shangyu Wu, Hongchao Du, Ying Xiong, Shuai Chen, Tei-Wei Kuo, Nan Guan, Chun Jason Xue

机构 * City University of Hong Kong(香港城市大学) Mohamed bin Zayed University of Artificial Intelligence(马尔代夫穆罕默德·本·扎耶德人工智能大学) Baidu(百度) National Taiwan University(国立台湾大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07221 2025-08-12 cs.LG cs.AI cs.MA stat.AP stat.ME 86%

LLM-based Agents for Automated Confounder Discovery and Subgroup Analysis in Causal Inference

Po-Han Lee, Yu-Cheng Lin, Chan-Tung Ku, Chan Hsu, Pei-Cing Huang, Ping-Hsun Wu, Yihuang Kang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏