arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2511.00664 2025-11-04 cs.CR cs.AI 85%

ShadowLogic: Backdoors in Any Whitebox LLM

Kasimir Schulz, Amelia Kawasaki, Leo Ring

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref Proceedings of Machine Learning Research 299:1-11, 2025 Conference on Applied Machine Learning for Information Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12872 2025-11-04 cs.MA cs.AI stat.ML 85%

KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems

Hancheng Ye, Zhengqi Gao, Mingyuan Ma, Qinsi Wang, Yuzhe Fu, Ming-Yu Chung, Yueqian Lin, Zhijian Liu, Jianyi Zhang, Danyang Zhuo, Yiran Chen

机构 * Duke University(杜克大学) MIT(麻省理工学院) NVIDIA(英伟达)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for publication in NeurIPS2025. Code is available at \url{https://github.com/FastMAS/KVCOMM}

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26096 2025-10-31 cs.SD cs.CR cs.LG 85%

ALMGuard: Safety Shortcuts and Where to Find Them as Guardrails for Audio-Language Models

Weifei Jin, Yuxin Cao, Junjie Su, Minhui Xue, Jie Hao, Ke Xu, Jin Song Dong, Derui Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) CSIRO’s Data61(CSIRO数据61) Responsible AI Research (RAIR) Centre, The University of Adelaide(负责任人工智能研究(RAIR)中心,阿德莱德大学) Tsinghua University(清华大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14808 2025-10-31 cs.DC cs.LG 85%

HyGen: Efficient LLM Serving via Elastic Online-Offline Request Co-location

Ting Sun, Penghan Wang, Fan Lai

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院) Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS 2025. 21 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19902 2025-10-30 cs.CL 85%

WEST: LLM based Speech Toolkit for Speech Understanding, Generation, and Interaction

Binbin Zhang, Chengdong Liang, Shuai Wang, Xuelong Geng, Zhao Guo, Haoyu Li, Hao Yin, Xipeng Yang, Pengshen Zhang, Changwei Ma, Lei Xie

机构 * Northwestern Polytechnical University(西北工业大学) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学) GuaSemi Speech A Team(GuaSemi语音团队) WeNet Community(WeNet社区)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15721 2025-10-30 cs.LG 85%

Bohdi: Heterogeneous LLM Fusion with Automatic Data Exploration

Junqi Gao, Zhichang Guo, Dazhi Zhang, Dong Li, Runze Liu, Pengfei Li, Kai Tian, Biqing Qi

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shanghai Innovation Institute(上海创新研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by NeurIPS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24605 2025-10-29 cs.CL 85%

Diffusion LLM with Native Variable Generation Lengths: Let [EOS] Lead the Way

Yicun Yang, Cong Wang, Shaobo Wang, Zichen Wen, Biqing Qi, Hanlin Xu, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Lab(上海人工智能实验室) Huawei(华为)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24051 2025-10-29 cs.CL 85%

Pie: A Programmable Serving System for Emerging LLM Applications

In Gim, Zhiyao Ma, Seung-seob Lee, Lin Zhong

机构 * Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments SOSP 2025. Source code available at https://github.com/pie-project/pie

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21433 2025-10-28 cs.SE cs.AI 85%

The Complexity Trap: Simple Observation Masking Is as Efficient as LLM Summarization for Agent Context Management

Tobias Lindenbauer, Igor Slinko, Ludwig Felder, Egor Bogomolov, Yaroslav Zharov

机构 * JetBrains Research(JetBrains研究院) School of Computation, Information and Technology, Technical University of Munich(技术大学慕尼黑计算、信息与技术学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments v3: DL4C camera-ready version to be presented at the 4th DL4C workshop co-located with NeurIPS '25; added OpenHands generality probe, added hybrid context management strategy

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22784 2025-10-28 cs.RO cs.AI 85%

PIP-LLM: Integrating PDDL-Integer Programming with LLMs for Coordinating Multi-Robot Teams Using Natural Language

Guangyao Shi, Yuwei Wu, Vijay Kumar, Gaurav S. Sukhatme

机构 * Department of Computer Science, University of Southern California(计算机科学系,南加州大学) GRASP Lab, University of Pennsylvania(GRASP实验室,宾夕法尼亚大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22256 2025-10-28 cs.CL 85%

SteerX: Disentangled Steering for LLM Personalization

Xiaoyan Zhao, Ming Yan, Yilun Qiu, Haoting Ni, Yang Zhang, Fuli Feng, Hong Cheng, Tat-Seng Chua

机构 * The Chinese University of Hong Kong, University of Science and Technology of China, National University of Singapore(香港中文大学、中国科学技术大学、新加坡国立大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10644 2025-10-28 cs.AI 85%

Hierarchical Optimization via LLM-Guided Objective Evolution for Mobility-on-Demand Systems

Yi Zhang, Yushen Long, Yun Ni, Liping Huang, Xiaohong Wang, Jun Liu

机构 * Agency for Science, Technology and Research(科技研究局) Morgan Stanley Asia Pte.(摩根大通亚洲公司) Onto Innovation Inc.(Onto Innovation公司) School of computing and communications, Lancaster University(兰卡斯特大学计算机与通讯学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02890 2025-10-28 cs.CR cs.IT cs.LG math.IT 85%

Theoretically Grounded Framework for LLM Watermarking: A Distribution-Adaptive Approach

Haiyun He, Yepeng Liu, Ziqiao Wang, Yongyi Mao, Yuheng Bu

机构 * HKUST (GZ)(香港科技大学(广州)) UC Santa Barbara(加州大学圣芭芭拉分校) Tongji University(同济大学) University of Ottawa(渥太华大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09501 2025-10-28 cs.CL 85%

Understanding and Mitigating Numerical Sources of Nondeterminism in LLM Inference

Jiayi Yuan, Hao Li, Xinheng Ding, Wenya Xie, Yu-Jhe Li, Wentian Zhao, Kun Wan, Jing Shi, Xia Hu, Zirui Liu

机构 * Rice University(Rice大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) Adobe Inc.(Adobe公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20524 2025-10-28 cs.LG 85%

Towards Fully FP8 GEMM LLM Training at Scale

Alejandro Hernández-Cano, Dhia Garbaya, Imanol Schlag, Martin Jaggi

机构 * EPFL(苏黎世联邦理工学院) ETHZ(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 19 pages including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18043 2025-10-22 cs.AI 85%

CompactPrompt: A Unified Pipeline for Prompt Data Compression in LLM Workflows

Joong Ho Choi, Jiayang Zhao, Jeel Shah, Ritvika Sonawane, Vedant Singh, Avani Appalla, Will Flanagan, Filipe Condessa

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Workshop on LLMs and Generative AI for Finance at ACM ICAIF 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15926 2025-10-22 cs.AR cs.LG 85%

TeLLMe v2: An Efficient End-to-End Ternary LLM Prefill and Decode Accelerator with Table-Lookup Matmul on Edge FPGAs

Ye Qiao, Zhiheng Chen, Yifan Zhang, Yian Wang, Sitao Huang

机构 * University of California, Irvine(加州大学 Irvine 分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14162 2025-10-22 cs.IR cs.AI 85%

FinAI Data Assistant: LLM-based Financial Database Query Processing with the OpenAI Function Calling API

Juhyeong Kim, Yejin Kim, Youngbin Lee, Hyunwoo Byun

机构 * Mirae Asset Global Investments AI Quant Lab, MODULABS Seoul Republic of Korea Meritz Fire \& Marine Insurance AI Quant Lab, MODULABS Seoul Republic of Korea Elice AI Quant Lab, MODULABS Seoul Republic of Korea AI Quant Lab, MODULABS

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages, 2 figures, accepted at CIKM 2025 FinAI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17814 2025-10-22 eess.SY cs.AI cs.SY 85%

LLM Assisted Alpha Fairness for 6 GHz WiFi and NR_U Coexistence: An Agentic Orchestrator for Throughput, Energy, and SLA

Qun Wang, Yingzhou Lu, Guiran Liu, Binrong Zhu, Yang Liu

机构 * Department of Computer Science, San Francisco State University(计算机科学系,旧金山州立大学) School of Medicine, Stanford University(医学院,斯坦福大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16040 2025-10-21 cs.AR cs.AI 85%

Kelle: Co-design KV Caching and eDRAM for Efficient LLM Serving in Edge Computing

Tianhua Xia, Sai Qian Zhang

机构 * Tandon School of Engineering(工程学院) New York University(纽约大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23052 2025-10-20 cs.CL 85%

RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models

Jiarui Zhang, Xiangyu Liu, Yong Hu, Chaoyue Niu, Fan Wu, Guihai Chen

机构 * Shanghai Jiao Tong University(上海交通大学) WeChat, Tencent Inc(微信、腾讯公司)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14392 2025-10-17 cs.DC cs.AI 85%

FairBatching: Fairness-Aware Batch Formation for LLM Inference

Hongtao Lyu, Boyue Liu, Mingyu Wu, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13918 2025-10-17 cs.CL 85%

Optimal Aggregation of LLM and PRM Signals for Efficient Test-Time Scaling

Peng Kuang, Yanli Wang, Xiaoyu Han, Yaowenqi Liu, Kaidi Xu, Haohan Wang

机构 * Zhejiang University(浙江大学) Imperial College London(伦敦帝国理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Drexel University(德雷塞尔大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13668 2025-10-16 cs.DC cs.LG 85%

Adaptive Rescheduling in Prefill-Decode Disaggregated LLM Inference

Zhibin Wang, Zetao Hong, Xue Li, Zibo Wang, Shipeng Li, Qingkai Meng, Qing Wang, Chengying Huan, Rong Gu, Sheng Zhong, Chen Tian

机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) Nanjing University(南京大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13285 2025-10-16 cs.CL 85%

In-Distribution Steering: Balancing Control and Coherence in Language Model Generation

Arthur Vogels, Benjamin Wong, Yann Choho, Annabelle Blangero, Milan Bhan

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13248 2025-10-16 cs.NI cs.LG 85%

Automated Network Protocol Testing with LLM Agents

Yunze Wei, Kaiwen Wei, Shibo Du, Jianyu Wang, Zhangzhong Liu, Yawen Wang, Zhanyou Li, Congcong Miao, Xiaohui Xie, Yong Cui

机构 * Tsinghua University(清华大学) Beijing Xinertel Technology Co., Ltd.(北京新ertel技术有限公司) Tencent(腾讯)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12721 2025-10-15 cs.LG 85%

CARVQ: Corrective Adaptor with Group Residual Vector Quantization for LLM Embedding Compression

Dayin Gou, Sanghyun Byun, Nilesh Malpeddi, Gabrielle De Micheli, Prathamesh Vaste, Jacob Song, Woo Seong Chung

机构 * LG Electronics USA(LG电子美国公司)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted at EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12343 2025-10-15 cs.LG cs.CR 85%

Traveling Salesman-Based Token Ordering Improves Stability in Homomorphically Encrypted Language Models

Donghwan Rho, Sieun Seo, Hyewon Sung, Chohong Min, Ernest K. Ryu

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12023 2025-10-15 cs.CL 85%

Information Extraction from Conversation Transcripts: Neuro-Symbolic vs. LLM

Alice Saebom Kwak, Maria Alexeeva, Gus Hahn-Powell, Keith Alcock, Kevin McLaughlin, Doug McCorkle, Gabe McNunn, Mihai Surdeanu

机构 * Department of Linguistics, University of Arizona(亚利桑那大学语言学系) Lum AI Eocene Environmental Group(Eocene环境集团)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04075 2025-10-15 cs.CL 85%

From Rational Answers to Emotional Resonance: The Role of Controllable Emotion Generation in Language Models

Yurui Dong, Luozhijie Jin, Yao Yang, Bingjie Lu, Jiaxi Yang, Zhi Liu

机构 * State Key Laboratory on Technologies for Chinese Medicine Pharmaceutical Process Control and Intelligent Manufacture(中药制药过程控制与智能制造技术国家重点实验室) Zhejiang Lab(浙江实验室)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 43 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏