arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22405 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22405 篇

2601.14862 2026-01-22 cs.LG cs.CL 84%

Strategic Doctrine Language Models (sdLM): A Learning-System Framework for Doctrinal Consistency and Geopolitical Forecasting

战略道义语言模型(sdLM):一种用于道义一致性和地缘政治预测的学习系统框架

Olaf Yunus Laitinen Imanov, Taner Yilmaz, Derya Umut Kulali

机构 * Department of Applied Mathematics and Computer Science (DTU Compute)(应用数学与计算机科学系(DTU计算)) Technical University of Denmark(丹麦技术大学) Department of Computer Engineering(计算机工程系) Afyon Kocatepe University(阿菲永卡拉伊斯大学) Department of Engineering(工程系) Eskisehir Technical University(埃斯克西赫尔技术大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 sdLM通过多文档注意力、时间编码和道义一致性层,提升地缘政治预测的准确性和道义一致性,优于通用大语言模型和人类专家。

Comments 13 pages, 10 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12904 2026-01-21 cs.CL cs.AI 84%

From Prefix Cache to Fusion RAG Cache: Accelerating LLM Inference in Retrieval-Augmented Generation

从前缀缓存到融合RAG缓存:加速检索增强生成中的LLM推理

Jiahao Wang, Weiyu Xie, Mingxing Zhang, Boxing Zhang, Jianwei Dong, Yuening Zhu, Chen Lin, Jinqi Tang, Yaochen Han, Zhiyuan Ai, Xianglin Chen, Yongwei Wu, Congfeng Jiang

机构 * Hangzhou Dianzi University(杭州电子科技大学) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 FusionRAG通过优化RAG的预处理和重处理阶段,在保持生成质量的同时提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12785 2026-01-21 cs.LG cs.AI 84%

Distilling Time Series Foundation Models for Efficient Forecasting

压缩时间序列基础模型以实现高效预测

Yuqi Li, Kuiye Ding, Chuanguang Yang, Szu-Yu Chen, Yingli Tian

机构 * The City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学) Institute of Computing Technology, Chinese Academy of Sciences, China(中国科学院计算技术研究所) Stevens Institute of Technology, USA(史蒂文斯理工学院)

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 DistilTS是一种专为时间序列基础模型设计的蒸馏框架,通过时间跨度加权目标和时间对齐策略,在减少参数量的同时保持预测性能。

Comments Accepted by ICASSP-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07839 2026-01-14 cs.LG cs.AI 84%

Hierarchical Sparse Plus Low Rank Compression of LLM

层级稀疏加低秩压缩LLM

Pawan Kumar, Aditi Gupta

机构 * International Institute of Information Technology, Hyderabad(国际信息科技研究所,海得拉巴)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HSS压缩方法,通过稀疏和低秩分解实现LLM的高效压缩,实验表明在内存节省的同时保持高性能。

Comments 9 pages, 3 figures, Accepted in ACM International Conference on Data Science, CODS-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06226 2026-01-13 cs.LG cs.AI 84%

Projecting Out the Malice: A Global Subspace Approach to LLM Detoxification

剔除恶意:一种全局子空间方法用于LLM去毒化

Zenghao Duan, Zhiyi Yin, Zhichao Shi, Liang Pang, Shaoling Jing, Zihe Huang, Jiayi Wu, Yu Yan, Jingcheng Deng, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室,计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Dalian University of Technology(大连理工大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出GLOSS方法,通过识别并消除LLM参数中的全局子空间来实现去毒化,有效提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23367 2026-01-09 cs.LG cs.AI 84%

Post-Training Quantization of OpenPangu Models for Efficient Deployment on Atlas A2

在Atlas A2上对OpenPangu模型进行训练后量化以实现高效部署

Yilun Luo, Huaqing Zheng, Haoqian Meng, Wenyuan Liu, Peng Zhang

机构 * School of Computer Science and Technology, Tianjin University(计算机科学与技术学院,天津大学)

专题命中 效率与部署 :post-training(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出在Atlas A2上通过低比特量化提升OpenPangu模型的推理效率,实现高效CoT推理并保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01966 2026-01-06 cs.LG cs.AI 84%

Refinement Provenance Inference: Detecting LLM-Refined Training Prompts from Model Behavior

细化溯源推断:从模型行为检测LLM细化训练提示

Bo Yin, Qi Li, Runpeng Yu, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学)

专题命中 效率与部署 :LLM(title,abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出RePro框架,通过教师强制的似然特征与logit排名信号融合,实现对LLM细化训练提示的溯源推断,具有跨模型和训练设置的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01296 2026-01-06 cs.CR cs.AI cs.LG 84%

Aggressive Compression Enables LLM Weight Theft

激进压缩使大语言模型权重窃取成为可能

Davis Brown, Juan-Pablo Rivera, Dan Hendrycks, Mantas Mazeika

机构 * University of Pennsylvania(宾夕法尼亚大学) Georgia Institute of Technology(佐治亚理工学院) Center for AI Safety(人工智能安全中心)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了通过压缩使大语言模型权重窃取风险增加的问题,提出通过放松解压缩约束来提升窃取效率,并探讨了三种防御方法以降低窃取风险。

Comments An early version of this work was presented at the SoLAR Workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20335 2026-01-06 cs.CL cs.AI 84%

Language Model Distillation: A Temporal Difference Imitation Learning Perspective

语言模型蒸馏:一种时差模仿学习视角

Zishun Yu, Shangzhe Li, Xinhua Zhang

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于时差学习的通用蒸馏框架,利用教师模型的分布稀疏性,通过缩减动作空间提升语言模型蒸馏效果。

Comments AAAI 2026; Code available at: https://github.com/TobyLeelsz/Bellman-Distillation

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15298 2026-01-05 cs.NE cs.CL cs.LG 84%

Sorbet: A Neuromorphic Hardware-Compatible Transformer-Based Spiking Language Model

Sorbet:一种兼容神经形态硬件的基于Transformer的脉冲语言模型

Kaiwen Tang, Zhanglu Yan, Weng-Fai Wong

机构 * School of Computing, National University of Singapore, Singapore, Singapore(新加坡国立大学计算机学院)

专题命中 效率与部署 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.LG

AI总结 Sorbet是一种基于Transformer的脉冲语言模型,通过PTsoftmax和BSPN替代高能耗操作,实现高效能的神经形态硬件兼容性。

Comments Accepted by ICML 2025. Camera-ready version

Journal ref Proceedings of the 42nd International Conference on Machine Learning (ICML), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23145 2025-12-30 cs.CL cs.AI 84%

Reservoir Computing inspired Matrix Multiplication-free Language Model

受回声计算启发的无矩阵乘法语言模型

Takumi Shiratsuchi, Yuichiro Tanaka, Hakaru Tamukoh

机构 * Graduate School of Life Science and Systems Engineering, Kyushu Institute of Technology, Japan(九州工学技术大学生命科学与系统工程研究生院) Research Center for Neuromorphic AI Hardware, Kyushu Institute of Technology, Japan(九州工学技术大学神经形态人工智能硬件研究中心)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出一种受回声计算启发的无矩阵乘法语言模型,通过共享权重和优化内存访问,有效降低计算成本并提升效率。

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13733 2025-12-17 cs.LG cs.AI 84%

Low-Rank Compression of Language Models via Differentiable Rank Selection

通过可微分秩选择实现语言模型的低秩压缩

Sidhant Sundrani, Francesco Tudisco, Pasquale Minervini

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 LLRC通过可微分方法实现语言模型的低秩压缩,在无需微调的情况下提升压缩率与下游任务准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15447 2025-12-15 cs.AI cs.LG 84%

From Bits to Boardrooms: A Cutting-Edge Multi-Agent LLM Framework for Business Excellence

从比特到董事会:一种面向企业卓越的多智能体大语言模型框架

Zihao Wang, Junming Zhang

机构 * College of Artificial Intelligence and Automation(人工智能与自动化学院) Hohai University(河海大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 BusiAgent是一种基于多智能体框架的LLM,通过整合CTMDP、熵度量和Stackelberg博弈等创新技术,提升企业决策的效率与质量。

Comments Accepted by ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14026 2025-12-09 cs.LG cs.CL stat.ML 84%

Demystifying Language Model Forgetting with Low-rank Example Associations

解开语言模型遗忘之谜:低秩示例关联

Xisen Jin, Xiang Ren

机构 * University of Southern California(南加州大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本文通过低秩矩阵分析揭示语言模型微调时遗忘的机制,并提出基于矩阵补全的方法有效缓解遗忘问题。

Comments NeurIPS 2025. Updated code and data URL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05811 2025-12-08 cs.LG cs.AI 84%

MOSS: Efficient and Accurate FP8 LLM Training with Microscaling and Automatic Scaling

MOSS:基于微缩和自动缩放的高效准确FP8大语言模型训练

Yu Zhang, Hui-Ling Zhen, Mingxuan Yuan, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学) Noah’s Ark Lab, Huawei(华为诺亚实验室)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 MOSS通过微缩和自动缩放技术,实现高效准确的FP8大语言模型训练,提升训练吞吐量34%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03623 2025-12-04 cs.LG cs.AI physics.ao-ph 84%

The promising potential of vision language models for the generation of textual weather forecasts

视觉语言模型在生成文本天气预报中的巨大潜力

Edward C. C. Steele, Dinesh Mane, Emilio Monti, Luis Orus, Rebecca Chantrill-Cheyette, Matthew Couch, Kirstine I. Dale, Simon Eaton, Govindarajan Rangarajan, Amir Majlesi, Steven Ramsdale, Michael Sharpe, Craig Smith, Jonathan Smith, Rebecca Yates, Holly Ellis, Charles Ewen

机构 * Met Office(英国气象局) Amazon Web Services(亚马逊网络服务) University of East Anglia(东安格利亚大学)

专题命中 效率与部署 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了视觉语言模型在直接生成文本天气预报中的潜力,通过视频编码的格网天气数据提升气象服务的生产效率与创新。

Comments 7 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22880 2025-12-01 cs.DC cs.AI cs.LG 84%

Serving Heterogeneous LoRA Adapters in Distributed LLM Inference Systems

在分布式大语言模型推理系统中服务异构LoRA适配器

Shashwat Jaiswal, Shrikara Arun, Anjaly Parayil, Ankur Mallick, Spyros Mastorakis, Alind Khare, Chloi Alverti, Renee St Amant, Chetan Bansal, Victor Rühle, Josep Torrellas

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软) National Technical University of Athens(雅典国家技术大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 LoRAServe通过动态适配器放置和路由框架,有效解决异构LoRA适配器在分布式大语言模型推理中的性能偏斜问题,提升吞吐量并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16595 2025-11-27 cs.CV cs.AI cs.CL 84%

TimeViper: A Hybrid Mamba-Transformer Vision-Language Model for Efficient Long Video Understanding

TimeViper: 一种用于高效长视频理解的混合Mamba-Transformer视觉语言模型

Boshen Xu, Zihan Xiao, Jiaze Li, Jianzhong Ju, Zhenbo Luo, Jian Luan, Qin Jin

机构 * AIM3 Lab, Renmin University of China(中国人民大学人工智能实验室) MiLM Plus, Xiaomi Inc.(小米公司)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 TimeViper是一种混合Mamba-Transformer模型,通过TransV模块实现高效长视频理解,提升多模态处理能力。

Comments Project page: https://xuboshen.github.io/TimeViper; Code: https://github.com/xiaomi-research/timeviper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21089 2025-11-27 cs.LG cs.AI 84%

MLPMoE: Zero-Shot Architectural Metamorphosis of Dense LLM MLPs into Static Mixture-of-Experts

MLPMoE:密集LLM架构的零样本架构变形

Ivan Novikov

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 MLPMoE通过零样本方法将密集LLM的MLP结构转换为静态混合专家,实现参数高效和计算节省。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18428 2025-11-26 cs.AI cs.CL 84%

Multi-Modal Data Exploration via Language Agents

通过语言代理进行多模态数据探索

Farhad Nooralahzadeh, Yi Zhang, Jonathan Furst, Kurt Stockinger

机构 * Zurich University of Applied Sciences(瑞士应用科学大学)

专题命中 效率与部署 :language agent(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出M$^2$EX系统,通过语言代理实现多模态数据探索,优于现有系统在准确性和性能指标上

Comments Accepted to the IJCNLP AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18977 2025-11-25 cs.LG cs.AI 84%

FastForward Pruning: Efficient LLM Pruning via Single-Step Reinforcement Learning

FastForward Pruning: 通过单步强化学习高效压缩大语言模型

Xin Yuan, Siqi Li, Jiateng Wei, Chengrui Zhu, Yanming Wu, Qingpeng Li, Jiajun Lv, Xiaoke Lan, Jun Chen, Yong Liu

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过单步强化学习高效压缩大语言模型,实现优于启发式基线的剪枝效果,显著提升搜索效率。

Comments 5 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17676 2025-11-25 cs.DB cs.AI cs.CL 84%

LLM and Agent-Driven Data Analysis: A Systematic Approach for Enterprise Applications and System-level Deployment

大语言模型与智能体驱动的数据分析:企业应用与系统级部署的系统方法

Xi Wang, Xianyao Ling, Kun Li, Gang Yin, Liang Zhang, Jiang Wu, Annie Wang, Weizhe Wang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种系统方法,利用大语言模型和智能体技术,提升企业数据分析的效率和安全性,解决复杂查询和分布式部署中的关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04427 2025-11-25 cs.AI cs.CL 84%

Plugging Schema Graph into Multi-Table QA: A Human-Guided Framework for Reducing LLM Reliance

将模式图嵌入多表问答:一种减少大语言模型依赖的人工引导框架

Xixi Wang, Miguel Costa, Jordanka Kovaceva, Shuai Wang, Francisco C. Pereira

机构 * Chalmers University of Technology(查尔姆斯理工大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于图的框架,利用人工整理的关系知识减少对大语言模型的依赖,有效解决多表问答中复杂表格模式链接的问题。

Comments Accepted to EMNLP 2025 findings

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06843 2025-11-25 cs.CL cs.AI 84%

Integrating Cognitive Processing Signals into Language Models: A Review of Advances, Applications and Future Directions

将认知处理信号整合进语言模型:关于进展、应用与未来方向的综述

Angela Lopez-Cardona, Sebastian Idesis, Ioannis Arapakis

机构 * Telefónica Scientific Research(Telefónica科学研究院) Universitat Politècnica de Catalunya(加泰罗尼亚理工大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本文综述了将认知信号,特别是眼动数据整合到语言模型中的最新进展、应用及未来方向,探讨了其在提升模型性能和解决环境成本方面的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10232 2025-11-14 cs.CL cs.AI cs.SD 84%

VocalNet-M2: Advancing Low-Latency Spoken Language Modeling via Integrated Multi-Codebook Tokenization and Multi-Token Prediction

Yuhao Wang, Ziyang Cheng, Heyang Liu, Ronghua Wu, Qunshan Gu, Yanfeng Wang, Yu Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

专题命中 效率与部署 :language model(title,abstract);SLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09748 2025-11-14 cs.CL cs.AI 84%

How Small Can You Go? Compact Language Models for On-Device Critical Error Detection in Machine Translation

Muskaan Chopra, Lorenz Sparrenberg, Sarthak Khanna, Rafet Sifa

机构 * Fraunhofer IAIS - Department of Media Engineering(弗劳恩霍夫人工智能研究所-媒体工程部门) University of Bonn - Department of Computer Science(波恩大学-计算机科学系) Lamarr Institute for Machine Learning(拉马尔人工智能与机器学习研究所)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in IEEE BigData 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11570 2025-11-12 cs.LG cs.AI 84%

Tool-Aided Evolutionary LLM for Generative Policy Toward Efficient Resource Management in Wireless Federated Learning

Chongyang Tan, Ruoqi Wen, Rongpeng Li, Zhifeng Zhao, Ekram Hossain, Honggang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang Lab(浙江实验室) University of Manitoba(曼尼托巴大学) Macau University of Science and Technology(澳门科学理工学院)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06776 2025-11-11 cs.LG cs.AI 84%

Data Trajectory Alignment for LLM Domain Adaptation: A Two-Phase Synthesis Framework for Telecommunications Mathematics

Zhicheng Zhou, Jing Li, Suming Qiu, Junjie Huang, Linyuan Qiu, Zhijie Sun

机构 * Global Technical Service (GTS) Huawei Technologies Co., Ltd(华为技术有限公司全球技术服务部)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05597 2025-11-11 cs.AI cs.LG 84%

From Prompts to Power: Measuring the Energy Footprint of LLM Inference

Francisco Caravaca, Ángel Cuevas, Rubén Cuevas

机构 * UC3M-Santander Big Data Institute(UC3M-桑坦德大数据研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04063 2025-11-07 cs.LG cs.CL 84%

DartQuant: Efficient Rotational Distribution Calibration for LLM Quantization

Yuantian Shao, Yuanteng Chen, Peisong Wang, Jianlin Yu, Jing Lin, Yiwu Yao, Zhihui Wei, Jian Cheng

机构 * Nanjing University of Science and Technology(南京理工大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025, 10 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏