arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22368 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22368 篇

2602.06777 2026-02-09 cs.CR cs.AI 88%

Next-generation cyberattack detection with large language models: anomaly analysis across heterogeneous logs

下一代基于大语言模型的网络攻击检测:跨异构日志的异常分析

Yassine Chagna, Antal Goldschmidt

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究提出基于大语言模型的下一代网络攻击检测方法,通过构建异构日志数据集和两阶段训练框架,实现高效准确的异常检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03815 2026-02-04 cs.CV cs.LG 88%

Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning

通过视觉标记修剪实现多模态大语言模型的快慢高效训练

Dingkun Zhang, Shuhan Qi, Yulin Wu, Xinyu Xiao, Xuan Wang, Long Chen

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 DualSpeed通过快慢双模式实现多模态大语言模型的高效训练,提升训练速度并保持性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03750 2026-02-04 cs.CV cs.AI 88%

Zero-shot large vision-language model prompting for automated bone identification in paleoradiology x-ray archives

零样本大视觉语言模型提示法用于古放射学x光档案中骨骼自动识别

Owen Dong, Lily Gao, Manish Kota, Bennett A. Landmana, Jelena Bekvalac, Gaynor Western, Katherine D. Van Schaik

专题命中 效率与部署 :language model(title,abstract);prompting(title,abstract);分类 cs.AI

AI总结 利用大视觉语言模型实现古放射学x光图像中骨骼自动识别,提升内容导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02501 2026-02-04 cs.LG cs.CR 88%

Augmenting Parameter-Efficient Pre-trained Language Models with Large Language Models

通过大语言模型增强参数高效预训练语言模型

Saurabh Anand, Shubham Malaviya, Manish Shukla, Sachin Lodha

机构 * TCS Research(TCS研究)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出通过大语言模型增强参数高效预训练语言模型,以提高网络安全领域模型的可靠性与鲁棒性。

Comments 22 pages, 9 figures, 11 tables, short paper was accepted in ACM SAC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01778 2026-02-03 cs.CL 88%

Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model

数据分布至关重要:一种以数据为中心的视角来探讨大型语言模型中的上下文压缩

Kangtao Lv, Jiwei Tang, Langming Liu, Haibin Chen, Weidong Zhang, Shilei Liu, Yongwei Wang, Yujin Yuan, Wenbo Su, Bo Zheng

机构 * Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Tsinghua University(清华大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文从数据分布角度探讨了大型语言模型中的上下文压缩问题,发现输入熵与压缩质量负相关,而内在数据差距影响压缩增益,提出优化压缩的实用指南。

Comments 15 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00885 2026-02-03 cs.LG 88%

Reliability-Aware Determinantal Point Processes for Robust Informative Data Selection in Large Language Models

可靠性感知的行列式点过程用于大型语言模型中鲁棒的信息数据选择

Ahmad Sarlak, Abolfazl Razi

机构 * Clemson University, Clemson, SC, USA(克林姆恩大学) School of Computing, Clemson University, Clemson, SC, USA(计算学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出ProbDPP,一种可靠性感知的行列式点过程,用于在不确定环境下实现鲁棒的信息数据选择,以提高大型语言模型的部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17112 2026-01-27 cs.LG 88%

Low-Rank Tensor Approximation of Weights in Large Language Models via Cosine Lanczos Bidiagonalization

通过余弦兰舍兹双线性化实现大语言模型权重的低秩张量近似

A. El Ichi, K. Jbilou

机构 * Université du Littoral Cote d’Opale(卢瓦尔海岸大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出通过余弦兰舍兹双线性化对大语言模型权重进行低秩张量近似,以提高计算效率和减少内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16615 2026-01-26 cs.CL 88%

AuroraEdge-V-2B: A Faster And Stronger Edge Visual Large Language Model

AuroraEdge-V-2B: 一种更快更强大的边缘视觉大语言模型

Xiang Chen

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 AuroraEdge-V-2B是一种为边缘部署设计的高性能视觉大语言模型,具有紧凑参数、高速推理和强大性能的特点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10739 2026-01-23 cs.CV cs.AI 88%

Efficient Multimodal Large Language Models: A Survey

高效多模态大语言模型:综述

Yizhang Jin, Jian Li, Yexin Liu, Tianjun Gu, Kai Wu, Zhengkai Jiang, Muyang He, Bo Zhao, Xin Tan, Zhenye Gan, Yabiao Wang, Chengjie Wang, Lizhuang Ma

机构 * Youtu Lab, Tencent(腾讯优图实验室) SJTU(上海交通大学) BAAI(北京人工智能研究院) ECNU(华东师范大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文综述了高效多模态大语言模型的发展现状,探讨了其高效结构、策略及应用,并展望了未来研究方向。

Comments Accepted by Visual Intelligence

Journal ref Visual Intelligence, Volume 3, article number 27, (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13143 2026-01-21 cs.LG 88%

FastAV: Efficient Token Pruning for Audio-Visual Large Language Model Inference

FastAV: 面向音频视觉大语言模型推理的高效令牌修剪

Chaeyoung Jung, Youngjoon Jang, Seungwoo Lee, Joon Son Chung

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 FastAV通过两阶段令牌修剪策略,针对音频视觉大语言模型实现高效推理,减少FLOPs超过40%并保持性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14669 2026-01-16 cs.LG 88%

Quartet: Native FP4 Training Can Be Optimal for Large Language Models

Quartet:原生FP4训练可用于大型语言模型

Roberto L. Castro, Andrei Panferov, Soroush Tabesh, Oliver Sieberling, Jiale Chen, Mahdi Nikdan, Saleh Ashkboos, Dan Alistarh

机构 * ISTA Red Hat AI(红帽人工智能) ETH Zürich(苏黎世联邦理工学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 Quartet通过原生FP4训练实现大型语言模型的高效训练,提供与FP16和FP8同等的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06399 2026-01-15 eess.SY cs.AI cs.SY 88%

An AI-Driven Thermal-Fluid Testbed for Advanced Small Modular Reactors: Integration of Digital Twin and Large Language Models

面向先进小型模块化反应堆的AI驱动热-流体测试平台:数字孪生与大语言模型的集成

Doyeong Lim, Yang Liu, Zavier Ndum Ndum, Christian Young, Yassin Hassan

机构 * organization= Department of Nuclear Engineering, Texas A\&M University , city= College Station , postcode= 77843 , state= TX , country= USA

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出一个结合数字孪生与大语言模型的AI驱动热-流体测试平台,用于加速小型模块化反应堆的创新与部署。

Journal ref AI Thermal Fluids, 100023 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07212 2026-01-13 cs.CL 88%

MI-PRUN: Optimize Large Language Model Pruning via Mutual Information

MI-PRUN:通过互信息优化大语言模型剪枝

Hao Zhang, Zhibin Zhang, Guangxin Wu, He Chen, Jiafeng Guo, Xueqi Cheng

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 MI-PRUN通过互信息方法优化大语言模型剪枝,利用隐藏状态转换识别冗余块,并结合数据处理不等式提升剪枝效率和稳定性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05191 2026-01-13 cs.CV cs.LG 88%

AgentCompress: Task-Aware Compression for Affordable Large Language Model Agents

AgentCompress: 任务感知压缩以实现经济高效的大型语言模型代理

Zuhair Ahmed Khan Taha, Mohammed Mudassir Uddin, Shahnawaz Alam

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 AgentCompress通过任务感知动态压缩技术,显著降低大型语言模型的计算成本,同时保持高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06843 2026-01-13 cs.CV cs.CL 88%

Speak While Watching: Unleashing TRUE Real-Time Video Understanding Capability of Multimodal Large Language Models

边看边说:解锁多模态大语言模型的实时视频理解能力

Junyan Lin, Junlong Tong, Hao Wu, Jialiang Zhang, Jinming Liu, Xin Jin, Xiaoyu Shen

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Institute of Digital Twin, EIT(宁波空间智能与数字衍生关键实验室,数字孪生研究院,EIT) Shanghai Jiao Tong University(上海交通大学) Ocean University of China(中国海洋大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出并行流式框架,通过三种设计解决多模态大语言模型在实时视频理解中的位置连续性约束问题,实现边看边说的实时交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06787 2026-01-13 cs.CL 88%

Garbage Attention in Large Language Models: BOS Sink Heads and Sink-aware Pruning

大语言模型中的垃圾注意力:BOS下沉头和下沉感知剪枝

Jaewon Sok, Jewon Yeom, Seonghyeon Park, Jeongjae Park, Taesup Kim

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学) Department of Rural Systems Engineering, Seoul National University(农村系统工程系,首尔国立大学) Department of Aerospace Engineering, Seoul National University(航空航天工程系,首尔国立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究提出通过BOS下沉分数识别并剪枝大语言模型中冗余的注意力头,以提升模型压缩效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06612 2026-01-13 cs.CR cs.LG 88%

Cross-Border Data Security and Privacy Risks in Large Language Models and IoT Systems

跨境数据安全与隐私风险在大语言模型和物联网系统中

Chalitha Handapangoda

机构 * Department of Computer Science and Engineering(计算机科学与工程系) NYU Tandon School of Engineering(纽约大学坦顿工程学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出一种主权意识的隐私由设计架构,通过动态整合本地加密、自适应差分隐私和实时合规性证明,有效降低跨境数据暴露风险并确保合规性。

Comments Final project for CS-GY 6813 at NYU Tandon School of Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16753 2026-01-07 cs.AI 88%

ELMM: Efficient Lightweight Multimodal Large Language Models for Multimodal Knowledge Graph Completion

ELMM: 为多模态知识图谱补全设计的高效轻量多模态大语言模型

Wei Huang, Peining Li, Meiyu Liang, Xu Hou, Junping Du, Yingxia Shao, Guanhua Ye, Wu Liu, Kangkang Lu, Yang Yu

机构 * School of Computer Science, Beijing University of Posts and Telecommunications(计算机学院,北京邮电大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 ELMM通过多视图视觉标记压缩和注意力修剪策略,高效解决多模态知识图谱补全中的模态冲突和计算成本问题,实现最先进的性能。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02674 2026-01-07 cs.CL 88%

Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration

迭代式结构剪枝用于具有多领域校准的大语言模型

Guangxin Wu, Hao Zhang, Zhang Zhibin, Jiafeng Guo, Xueqi Cheng

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出了一种迭代式结构剪枝方法,通过多领域校准集和迭代策略实现高效模型压缩,减少计算开销和内存占用,同时保持性能稳定。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02298 2026-01-06 cs.CL eess.SP 88%

Power-of-Two Quantization-Aware-Training (PoT-QAT) in Large Language Models (LLMs)

功率为二的量化感知训练(PoT-QAT)在大语言模型(LLMs)中

Mahmoud Elgenedy

机构 * Department of Computer Science, Stanford University(计算机科学系,斯坦福大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究提出了一种基于功率为二量化的量化感知训练方法,通过减少内存占用和提升推理速度,显著提升了大语言模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00936 2026-01-06 cs.CR cs.AI 88%

Emoji-Based Jailbreaking of Large Language Models

基于表情符号的大型语言模型劫持

M P V S Gopinadh, S Mahaboob Hussain

机构 * Vishnu Institute of Technology(维什努技术学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究通过测试基于表情符号的提示揭示了大型语言模型在安全对齐方面的漏洞,发现不同模型对表情符号攻击的响应存在显著差异,强调了在提示层面加强安全机制的重要性。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00202 2026-01-05 cs.CL 88%

Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models

基于大语言模型的时序知识图谱推理知识蒸馏

Wang Xing, Wei Song, Siyu Lin, Chen Wu, Zhesi Li, Man Wang

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院) School of Information Science and Engineering, Chongqing Jiaotong University(重庆交通大学信息科学与工程学院) School of Information Engineering, Chang’an University(长安大学信息工程学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出基于大语言模型的时序知识图谱推理蒸馏框架,通过有效转移结构和时间推理能力,提升学生模型的时效建模能力,实现高效部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21859 2025-12-29 cs.CL 88%

TimeBill: Time-Budgeted Inference for Large Language Models

TimeBill: 为大语言模型设计的时间预算推理方法

Qi Fan, An Zou, Yehan Ma

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 TimeBill提出了一种时间预算推理框架,通过细粒度响应长度预测和执行时间估计,提升大语言模型在时间敏感任务中的效率和响应性能。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16650 2025-12-19 cs.AI cs.CR 88%

Prefix Probing: Lightweight Harmful Content Detection for Large Language Models

前缀探查:用于大型语言模型的轻量有害内容检测

Jirui Yang, Hengqi Guo, Zhihui Lu, Yi Zhao, Yuansen Zhang, Shijing Hu, Qiang Duan, Yinggui Wang, Tao Wei

机构 * Fudan University(复旦大学) Ant Group(蚂蚁集团) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 Prefix Probing通过高效前缀探查实现轻量有害内容检测,在保持检测效果的同时大幅降低计算成本和部署需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14925 2025-12-19 cs.CL 88%

Multiscale Aggregated Hierarchical Attention (MAHA): A Game Theoretic and Optimization Driven Approach to Efficient Contextual Modeling in Large Language Models

多尺度聚合层次注意力(MAHA):一种基于博弈论和优化驱动的高效上下文建模方法,用于大型语言模型

Caner Erden

机构 * Sakarya University of Applied Sciences(萨卡里亚应用科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 MAHA通过层次化分解和数学优化方法,提升大型语言模型在长上下文任务中的计算效率与上下文建模能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15766 2025-12-19 cs.PL cs.AI cs.DC cs.PF 88%

LOOPRAG: Enhancing Loop Transformation Optimization with Retrieval-Augmented Large Language Models

LOOPRAG:通过检索增强的大语言模型增强循环变换优化

Yijie Zhi, Yayu Cao, Jianhua Dai, Xiaoyang Han, Jingwen Pu, Qingran Wu, Sheng Cheng, Ming Cai

机构 * Zhejiang University(浙江大学) Zhejiang Institute of Administration(浙江行政研究院) Beijing ShenZhou Aerospace Software Technology Ltd.(北京神舟航天软件技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 LOOPRAG通过检索增强大语言模型提升循环变换优化效率,实现代码生成的准确性和性能提升。

Comments Accepted to ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14717 2025-12-18 cs.LG 88%

Is GPT-OSS All You Need? Benchmarking Large Language Models for Financial Intelligence and the Surprising Efficiency Paradox

GPT-OSS真的足够吗?对大型语言模型进行金融智能评估及令人惊讶的效率悖论

Ziqian Bi, Danyang Zhang, Junhao Song, Chiung-Yi Tseng

机构 * Purdue University(普渡大学) Independent Researcher(独立研究者) Imperial College London(帝国理工学院伦敦分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文评估了GPT-OSS在金融NLP任务中的表现,发现较小的模型在效率和性能上优于更大的竞争对手。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01170 2025-12-17 cs.AI 88%

DART: Difficulty-Adaptive Reasoning Truncation for Efficient Large Language Models

DART: 为高效大语言模型的难度自适应推理截断

Ruofan Zhang, Bin Xia, Zhen Cheng, Cairen Jian, Minglun Yang, Ngai Wong, Yuan Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CSE Department, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Research and Development Department, SIMMIR Tech(Simmir科技研发部) School of Information Science and Technology, Xiamen University Tan Kah Kee College(厦门大学信息科学与技术学院) The University of Hong Kong(香港大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 DART通过自适应调整推理长度提升大语言模型效率,实现81.2%的推理截断和5.33倍的计算加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14069 2025-12-17 cs.AI 88%

RADAR: Accelerating Large Language Model Inference With RL-Based Dynamic Draft Trees

RADAR: 通过基于强化学习的动态草稿树加速大语言模型推理

Junjie Ma, Jinlong Li

机构 * School of Computer Science(计算机科学学院) University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 RADAR通过基于强化学习的动态草稿树方法,有效提升大语言模型推理速度,实现3.17至4.82倍的加速效果。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05915 2025-12-16 cs.CL 88%

Accelerating Large Language Model Inference via Early-Exiting Algorithms

通过早退算法加速大语言模型推理

Sangmin Bae

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究通过设计高效的并行解码机制和深度参数共享架构,结合预训练轻量级路由器,实现大语言模型推理的高效与性能平衡。

Comments PhD Dissertation

详情

展开后加载摘要…

URL PDF HTML 收藏