arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22405 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22405 篇

2510.04595 2026-04-21 cs.NE 89%

SpikingMamba: Towards Energy-Efficient Large Language Models via Knowledge Distillation from Mamba

SpikingMamba: 通过从Mamba知识蒸馏实现能量高效的大型语言模型

Yulong Huang, Jianxiong Tang, Chao Wang, Ziyi Wang, Jianguo Zhang, Zhichao Lu, Bojun Cheng, Luziwei Leng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

AI总结 SpikingMamba通过知识蒸馏从Mamba模型中实现高效能的Spiking神经网络大型语言模型,结合SI-LIF神经元和SGC路径,在保持精度的同时显著降低能耗。

Journal ref Transactions on Machine Learning Research (01/2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15488 2026-04-20 cs.LG cs.AI cs.CL 89%

FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models

FineSteer: 一种用于大语言模型推理时细粒度引导的统一框架

Zixuan Weng, Jinghuai Zhang, Kunlin Cai, Ying Li, Peiran Wang, Yuan Tian

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出FineSteer框架,通过条件引导和细粒度向量合成两个阶段实现高效引导,保留模型效用并提升引导效果,实验显示其在安全性和真实性基准上表现优异。

Comments Accepted by ACL 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00989 2026-04-15 cs.SE 89%

Sustainable Code Generation Using Large Language Models: A Systematic Literature Review

利用大语言模型实现可持续代码生成:系统文献综述

Sabiya Banu Masthan Ali, Oussema Kirmani, Aroosa Hameed, Syed Muhammad Danish, Gautam Srivastava

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文系统回顾了大语言模型生成代码的可持续性研究,分析了代码效率对环境影响,指出现有研究存在方法分散、缺乏统一评估框架的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23970 2026-04-14 cs.DC cs.AR 89%

Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving

在绿色时缓存提示:面向大型语言模型服务的碳感知缓存

Yuyang Tian, Desen Sun, Yi Ding, Sihang Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出GreenCache框架,通过动态资源分配平衡碳排放与服务等级协议,实现在LLM服务中减少15.1%的碳排放,最高达25.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09017 2026-04-13 cs.NI 89%

Multimodal Large Language Model Enabled Robust Beamforming for HAP Downlink Communications

多模态大语言模型赋能的HAP下行链路鲁棒波束成形

Xiaoyu Xing, Peng Yang, Guoquan Tao, Dingyi Lu, Zehui Xiong, Xianbin Cao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于多模态大语言模型的波束成形框架,通过飞行 telemetry 预测HAP姿态并实现鲁棒下行通信,提升用户服务比和总速率22.1%和12.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01400 2026-04-13 cs.CV 89%

Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models

通过局部和全局上下文优化实现高效视频大语言模型的token缩减

Jinlong Li, Liyuan Jiang, Haonan Zhang, Nicu Sebe

机构 * University of Trento(特伦托大学) Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出AOT方法,通过局部-全局最优传输优化视频大语言模型中的token,实现高效的token缩减,保持时间与视觉保真度。

Comments CVPR2026, Project webpage: https://tyroneli.github.io/AOT

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03857 2026-04-07 cs.NI 89%

CCA Reimagined: An Exploratory Study of Large Language Models for Congestion Control

CCA Reimagined: 一种大型语言模型用于拥塞控制的探索性研究

Xiaoxuan Qin, Yufei Wang, Longfei Shangguan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文通过模拟引导研究,系统探讨了大型语言模型驱动的拥塞控制可行性,提出更通用的LLM拥塞控制策略,实验表明LLM方案在动态网络条件下可降低延迟达50%,仅牺牲极小吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03414 2026-04-07 cs.CV 89%

KiToke: Kernel-based Interval-aware Token Compression for Video Large Language Models

KiToke:基于核的区间感知令牌压缩用于视频大语言模型

Haifeng Huang, Yang Li

机构 * Department of Computer Science, Iowa State University(爱荷华州立大学计算机科学系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 KiToke通过全局核冗余度测量和区间感知令牌合并,有效压缩视频大语言模型的视觉令牌,提升效率并保持关键信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00446 2026-04-07 cs.CR 89%

Exposing the Ghost in the Transformer: Abnormal Detection for Large Language Models via Hidden State Forensics

揭示Transformer中的幽灵:通过隐藏状态取证实现大语言模型的异常检测

Shide Zhou, Kailong Wang, Ling Shi, Haoyu Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出通过隐藏状态取证检测大语言模型异常行为,实现实时高效的安全威胁识别,检测准确率超95%,计算开销极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13307 2026-04-03 cs.NI 89%

Cooperative Edge Caching with Large Language Model in Wireless Networks

无线网络中基于大语言模型的协同边缘缓存

Ning Yang, Wentao Wang, Lingtao Ouyang, Haijun Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于大语言模型的集中式多基站缓存替换控制器,通过确定性文本到动作循环实现协同缓存替换,优于传统方法,在缓存容量、库大小、流行度偏斜和用户密度等方面表现出鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28576 2026-03-31 cs.CE 89%

Tiered Super-Moore's Law: Price Evolution, Production Frontiers, and Market Competition in Large Language Model Inference Services

分层超级摩尔定律:大型语言模型推理服务中的价格演变、生产前沿与市场竞争

Mingdeng Du

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文系统分析了大型语言模型推理市场中token定价,发现token价格下降约600倍,并提出分层超级摩尔假说,揭示软件和架构创新驱动价格下降,而非硬件进步。

Comments 23 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24361 2026-03-26 cs.RO 89%

LATS: Large Language Model Assisted Teacher-Student Framework for Multi-Agent Reinforcement Learning in Traffic Signal Control

LATS:基于多智能体强化学习的交通信号控制中的大语言模型辅助教师-学生框架

Yifeng Zhang, Peizhuo Li, Tingguang Zhou, Mingfeng Fan, Guillaume Sartoretti

机构 * Department of Mechanical Engineering, National University of Singapore(新加坡国立大学机械工程系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出LATS框架,结合大语言模型和多智能体强化学习,通过教师-学生模块提升交通信号控制的表示能力,实验表明其在多样交通场景中具有更高效和泛化性强的控制策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20161 2026-03-23 cs.CL cs.AI cs.LG 89%

Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models

语义标记聚类用于大型语言模型中的高效不确定性量化

Qi Cao, Andrew Gambardella, Takeshi Kojima, Yutaka Matsuo, Yusuke Iwasawa

机构 * The University of Tokyo(东京大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出语义标记聚类方法,通过语义信息高效量化大型语言模型的不确定性,无需辅助模型且计算开销低。

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08448 2026-03-19 cs.MA 89%

Scalable UAV Multi-Hop Networking via Multi-Agent Reinforcement Learning with Large Language Models

通过多智能体强化学习与大语言模型实现可扩展的UAV多跳网络

Yanggang Xu, Jirong Zha, Weijie Hong, Xiangmin Yi, Geng Chen, Jianfeng Zheng, Chen-Chun Hsia, Xinlei Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出MRLMN框架,结合多智能体强化学习和大语言模型,提升UAV多跳网络性能,通过分组策略和奖励分解增强算法可扩展性,并利用知识蒸馏提升训练效率。

Comments 18 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16382 2026-03-18 cs.CR 89%

Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models

旋转鲁棒性:一种对抗大语言模型位翻转攻击的无训练防御方法

Deng Liu, Song Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出旋转鲁棒性(RoR),通过正交Householder变换对激活空间进行旋转,有效消除激活异常值与敏感权重之间的对齐,提升大语言模型的可靠性。

Comments 13 pages, 8 figures. Preprint. Under review at IEEE Transactions on Information Forensics and Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13313 2026-03-17 cs.RO 89%

MRPoS: Mixed Reality-Based Robot Navigation Interface Using Spatial Pointing and Speech with Large Language Model

基于混合现实的机器人导航接口:结合空间指针与语音及大语言模型

Eduardo Iglesius, Masato Kobayashi, Yuki Uranishi

机构 * The University of Osaka(大阪大学) Kobe University(Kobe大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出MRPoS接口,利用空间指针和语音交互替代传统手势,提升机器人导航的直观性和效率,实验表明任务完成时间与工作负荷显著降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11877 2026-03-13 eess.AS 89%

Silent Speech Interfaces in the Era of Large Language Models: A Comprehensive Taxonomy and Systematic Review

在大语言模型时代的大声接口:全面的分类法和系统性综述

Kele Xu, Yifan Wang, Ming Feng, Qisheng Xu, Wuyang Chen, Yutao Dou, Cheng Yang, Huaimin Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

AI总结 本文综述了在大语言模型时代无声语音接口的发展,探讨了从传统传感器到意图执行的分类法,分析了生物信号处理的转变,并提出了未来发展方向和伦理边界。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11828 2026-03-13 physics.optics 89%

Large language models for optical network O&M: Agent-embedded workflow for automation

大语言模型用于光网络运维:嵌入代理的工作流自动化

Shengnan Li, Yidi Wang, Fubin Wang, Yujia Yang, Yao Zhang, Yuchen Song, Xiaotian Jiang, Yue Pang, Min Zhang, Danshi Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于代理的多代理协作架构,利用大语言模型提升光网络运维的自动化水平,通过整合LLM能力与现有工具,实现任务执行的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16083 2026-03-13 cs.CL cs.AI cs.LG 89%

Efficient Compositional Multi-tasking for On-device Large Language Models

高效设备端大语言模型的组合多任务处理

Ondrej Bohdal, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种高效的设备端多任务处理方法,通过任务融合提升大语言模型在复杂多任务场景中的性能。

Comments Accepted at EMNLP 2025 (main track, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09922 2026-03-09 cs.DC 89%

λScale: Enabling Fast Scaling for Serverless Large Language Model Inference

λScale: 为无服务器大型语言模型推理实现快速扩展

Minchen Yu, Rui Yang, Chaobo Jia, Zhaoyuan Su, Sheng Yao, Tingfeng Lan, Yuchen Yang, Zirui Wang, Yue Cheng, Wei Wang, Ao Wang, Ruichuan Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 λScale通过高效模型组播和分布式推理实现无服务器LLM推理的快速扩展,显著提升延迟性能并降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04800 2026-03-06 cs.CV 89%

MASQuant: Modality-Aware Smoothing Quantization for Multimodal Large Language Models

MASQuant: 多模态大语言模型的模态感知平滑量化

Lulu Hu, Wenhu Xiao, Xin Chen, Xinhua Xu, Bowen Xu, Kun Li, Yongliang Tao

机构 * Alibaba Cloud Computing, Alibaba Group(阿里巴巴云 computing,阿里巴巴集团)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract)

AI总结 MASQuant通过模态感知平滑和跨模态补偿技术,解决多模态大语言模型的量化问题,实现稳定且高效的量化性能。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02686 2026-03-05 cs.IT math.IT 89%

Large Language Model Empowered CSI Feedback in Massive MIMO Systems

大语言模型赋能的海量MIMO系统中的CSI反馈

Jie Wu, Wei Xu, Le Liang, Xiaohu You, Mérouane Debbah

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出利用大语言模型进行CSI反馈,通过掩码标记预测和自信息策略提升压缩反馈的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02901 2026-03-04 cs.HC 89%

Speech recognition assisted by large language models to command software orally -- Application to an augmented and virtual reality web app for immersive molecular graphics

通过大型语言模型辅助的语音识别来控制软件——应用于增强和虚拟现实网页应用中的沉浸式分子图形

Fabio Cortes Rodriguez, Luciano Abriata

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 通过结合Chrome的语音识别和大型语言模型的函数调用方法,开发了一个语音控制网页应用,用于沉浸式分子图形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22158 2026-02-26 cs.DC 89%

LLMTailor: A Layer-wise Tailoring Tool for Efficient Checkpointing of Large Language Models

LLMTailor: 一种用于大型语言模型高效检查点存储的分层定制工具

Minqiu Sun, Xin Huang, Luanzheng Guo, Nathan R. Tallent, Kento Sato, Dong Dai

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 LLMTailor通过分层定制工具实现大型语言模型高效检查点存储,减少存储开销和检查点时间,同时保持模型质量。

Comments 9 pages, 3 figures, accepted at PDSW'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21547 2026-02-26 cs.DB 89%

RAC: Relation-Aware Cache Replacement for Large Language Models

基于关系的大型语言模型缓存替换策略RAC

Yuchong Wu, Zihuan Xu, Wangze Ni, Peng Cheng, Lei Chen, Xuemin Lin, Heng Tao Shen, Kui Ren

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 RAC通过利用请求之间的语义关系,提出了一种高效的缓存替换策略,显著提升了缓存命中率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20489 2026-02-25 cs.CE 89%

Application of Large Language Models for Container Throughput Forecasting: Incorporating Contextual Information in Port Logistics

大型语言模型在集装箱吞吐量预测中的应用:在港口物流中融入上下文信息

Minseop Kim, Jaeeun Kwon, Hanbyeol Park, Kikun Park, Taekhyun Park, Hyerim Bae

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本研究利用大型语言模型预测集装箱吞吐量,通过设计新的提示结构融入港口运营上下文信息,实验表明其优于现有方法,并探讨了LLM在港口物流中的应用约束与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16760 2026-02-20 cs.CR cs.DC 89%

Privacy-Aware Split Inference with Speculative Decoding for Large Language Models over Wide-Area Networks

面向宽域网络的隐私保护分割推断与推测解码

Michael Cunningham

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出一种隐私保护的大语言模型分割推断系统,通过非对称层分割和lookahead解码技术,在宽域网络上实现高吞吐量和隐私安全的LLM推断。

Comments 21 pages, 21 tables, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09135 2026-02-20 cs.SE 89%

HAFix: History-Augmented Large Language Models for Bug Fixing

HAFix: 历史增强型大语言模型用于缺陷修复

Yu Shi, Abdul Ali Bangash, Emad Fallahzadeh, Bram Adams, Ahmed E. Hassan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 HAFix通过整合历史启发式方法提升LLM在缺陷修复中的性能,实验表明其在缺陷修复率上显著优于基线方法。

Comments Accepted at Empirical Software Engineering (EMSE) 2026 Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01024 2026-02-17 cs.DC 89%

Low-Latency Federated Fine-Tuning for Large Language Models Over Wireless Networks

面向无线网络的低延迟联邦微调框架用于大语言模型

Zhiwen Pang, Kang Wei, Long Shi, Zhe Wang, Jun Li, Feng Shu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出了一种联合客户端特定剪枝和带宽分配框架,以提高无线网络下大语言模型的微调效率,实验表明其在减少训练时间的同时降低了计算和通信开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13266 2026-02-17 cs.DB cs.PF 89%

LoPace: A Lossless Optimized Prompt Accurate Compression Engine for Large Language Model Applications

LoPace:一种无损优化提示准确压缩引擎,用于大语言模型应用

Aman Ulla

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 LoPace通过三种压缩方法实现提示存储的高效无损压缩,平均节省72.2%空间,适用于大语言模型应用。

Comments 42 pages, 14 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏