arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-01 至 2026-01-01 共收录 35 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 35 篇

2507.02002 2026-01-01 cs.MA 89%

Dynamic Strategy Adaptation in Multi-Agent Environments with Large Language Models

多智能体环境中基于大语言模型的动态策略适应

Shaurya Mallampati, Rashed Shelim, Walid Saad, Naren Ramakrishnan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于大语言模型和博弈论的动态策略适应框架,提升多智能体协作效率和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24044 2026-01-01 cs.CR cs.AI cs.CL 86%

Jailbreaking Attacks vs. Content Safety Filters: How Far Are We in the LLM Safety Arms Race?

对抗攻击与内容安全过滤:我们在LLM安全竞赛中走了多远?

Yuan Xin, Dingfan Chen, Linyi Yang, Michael Backes, Xiao Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全中心) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Southern University of Science and Technology(南方科技大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文系统评估了针对LLM安全对齐的劫持攻击,发现大多数攻击可被安全过滤器检测到,同时指出需优化召回率和精确度以提升安全系统性能。

Comments 26 pages,11 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23765 2026-01-01 cs.CL cs.AI 86%

Entropy-Aware Speculative Decoding Toward Improved LLM Reasoning

基于熵的推测解码:改进大语言模型推理

Tiancheng Su, Meicong Zhang, Guoxiu He

机构 * School of Economics and Management(经济管理学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 基于熵的推测解码通过动态熵惩罚提升大语言模型推理性能,实验表明其在多数情况下优于目标模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24739 2026-01-01 cs.SD 86%

SLM-TTA: A Framework for Test-Time Adaptation of Generative Spoken Language Models

SLM-TTA: 生成式语音语言模型的测试时适应框架

Yuan-Kuei Wu, Yang Liu, Yiteng Huang, Zhaojun Yang, Haibin Wu, Ruizhe Huang, Yi-Te, Hsu, Shuyu Kong, Ming Sun, Florian Metze, Li Wan

机构 * Graduate Institute of Communication Engineering, National Taiwan University, Taiwan(台湾国立台湾大学通信工程研究所) Meta, USA(Meta公司)

专题命中 效率与部署 :language model(title,abstract);SLM(title)

AI总结 SLM-TTA框架通过测试时适应提升生成式语音语言模型在复杂语音环境中的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24750 2026-01-01 cs.NI 85%

Analyzing Communication Predictability in LLM Training

分析在LLM训练中的通信可预测性

Wenxue Li, Xiangzhou Liu, Yuxuan Li, Yilun Jin, Zhenghang Ren, Xudong Liao, Han Tian, Bo Ren, Zhizhen Zhong, Guyue Liu, Ying Zhang, Kai Chen

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究系统分析了LLM训练中的通信可预测性,提出ConfigTuner工具,通过优化配置提升了训练吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24511 2026-01-01 cs.DC 82%

Understanding LLM Checkpoint/Restore I/O Strategies and Patterns

理解LLM检查点/恢复I/O策略和模式

Mikaila J. Gossman, Avinash Maurya, Bogdan Nicolae, Jon C. Calhoun

专题命中 效率与部署 :LLM(title,abstract);foundation model(abstract)

AI总结 本文研究了LLM检查点/恢复I/O策略,通过微基准测试发现聚合和合并策略能显著提升写入吞吐量,比现有方法提高3.9至7.6倍。

Comments SCA/HPCAsia 2026 Workshops: Supercomputing Asia and International Conference on High Performance Computing in the Asia Pacific Region Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24473 2026-01-01 cs.CV cs.AI eess.IV 79%

F2IDiff: Real-world Image Super-resolution using Feature to Image Diffusion Foundation Model

F2IDiff: 利用特征到图像扩散基础模型进行现实世界图像超分辨率

Devendra K. Jangid, Ripon K. Saha, Dilshan Godaliyadda, Jing Li, Seok-Jun Lee, Hamid R. Sheikh

机构 * MPI Lab, Samsung Research America(Samsung Research America研究院)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 F2IDiff通过使用低层次特征条件的扩散模型提升现实世界图像超分辨率性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08151 2026-01-01 cs.AI 79%

Foundation Models Knowledge Distillation For Battery Capacity Degradation Forecast

基础模型知识蒸馏用于电池容量退化预测

Joey Chan, Zhen Chen, Ershun Pan

机构 * Department of Industrial Engineering and Management, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(工业工程与管理系,机械工程学院,上海交通大学,上海200240,中国)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于基础模型和知识蒸馏的电池容量退化预测方法,通过微调和蒸馏提升模型的泛化能力和部署效率。

Journal ref Reliability Engineering & System Safety, Volume 270, 2026, 112139, ISSN 0951-8320,

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18785 2026-01-01 cs.LG 79%

ALF: Advertiser Large Foundation Model for Multi-Modal Advertiser Understanding

ALF:多模态广告商基础模型用于多模态广告商理解

Santosh Rajagopalan, Jonathan Vronsky, Songbai Yan, S. Alireza Golestaneh, Shubhra Chandra, Min Zhou

机构 * Google(谷歌)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 ALF通过多模态Transformer架构和多任务优化,实现了广告商行为理解的高精度和高召回率,显著提升了欺诈检测和政策识别的性能。

Comments KDD 2026 ADS Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23858 2026-01-01 cs.LG cs.PL 79%

Yggdrasil: Bridging Dynamic Speculation and Static Runtime for Latency-Optimal Tree-Based LLM Decoding

Yggdrasil:连接动态推测与静态运行时以实现延迟最优的树基LLM解码

Yue Guan, Changming Yu, Shihan Fang, Weiming Hu, Zaifeng Pan, Zheng Wang, Zihan Liu, Yangjie Zhou, Yufei Ding, Minyi Guo, Jingwen Leng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Qizhi Institute(上海启智研究院) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

AI总结 Yggdrasil通过上下文感知的树起草和编译友好的执行,实现延迟最优的树基LLM解码,支持未经修改的LLM并在多种硬件上实现3.98倍速度提升。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24939 2026-01-01 cs.HC cs.CL 77%

Vibe Coding, Interface Flattening

vibe coding作为界面扁平化的现象

Hongrui Jin

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文探讨了vibe coding作为界面扁平化的现象,分析了大型语言模型如何通过重新配置编程界面,改变人机交互的政治经济结构。

Comments 16 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24614 2026-01-01 cs.NI cs.AI 77%

Chat-Driven Optimal Management for Virtual Network Services

基于聊天的虚拟网络服务最优管理

Yuya Miyaoka, Masaki Inoue, Kengo Urata, Shigeaki Harada

机构 * Department of Applied Physics and Physico-Informatics, Keio University(应用物理与物理信息学系,庆应大学) Network Service Laboratories, NTT, Inc.(网络服务实验室,NTT公司) IOWN Product Design Center, NTT, Inc.(IOWN产品设计中心,NTT公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种结合NLP与优化的聊天驱动虚拟网络管理框架,通过意图提取和优化算法实现网络配置的动态更新与高可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24545 2026-01-01 cs.LG cs.AI cs.CL stat.ML 75%

More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization

超越比特:用于极低比特量化的大规模语言模型的多包双二进制分解

Yuma Ichikawa, Yoshihiko Fujisawa, Yudai Fujimoto, Akira Sakai, Katsuki Fujisawa

机构 * Fujitsu Limited(富士通株式会社) RIKEN Center for AIP(理化学研究所AIP中心) Institute of Science Tokyo(东京科学研究所) Tokai University(立命馆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出多包双二进制分解(MDBF)以提升大规模语言模型在极低比特量化下的性能,通过共享符号基和优化初始化方法,在保持部署友好性的同时提高准确性和效率。

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20290 2026-01-01 cs.CR 75%

APT-CGLP: Advanced Persistent Threat Hunting via Contrastive Graph-Language Pre-Training

APT-CGLP: 通过对比图-语言预训练实现高级持续威胁狩猎

Xuebo Qiu, Mingqi Lv, Yimei Zhang, Tieming Chen, Tiantian Zhu, Qijie Song, Shouling Ji

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 APT-CGLP通过对比图-语言预训练实现高级持续威胁狩猎,提升跨模态语义匹配的准确性和效率。

Comments Accepted by SIGKDD 2026 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25059 2026-01-01 cs.DC cs.LG cs.NI 74%

Reliable and Resilient Collective Communication Library for LLM Training and Serving

用于LLM训练和服务的可靠且容错的集体通信库

Wei Wang, Nengneng Yu, Sixian Xiong, Zaoxing Liu

专题命中 效率与部署 :LLM(title);分类 cs.LG

AI总结 R$^2$CCL通过多NIC硬件实现无损低开销故障转移,提升LLM训练和推断的可靠性与容错能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13886 2026-01-01 cs.LG cs.AI cs.PF 73%

OPTIMA: Optimal One-shot Pruning for LLMs via Quadratic Programming Reconstruction

通过二次规划重构实现LLM的最优单次剪枝:OPTIMA

Mohammad Mozaffari, Samuel Kushnir, Maryam Mehri Dehnavi, Amir Yazdanbakhsh

机构 * University of Toronto(多伦多大学) Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :LLM(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 OPTIMA通过二次规划重构实现LLM的高效单次剪枝,提升零样本性能达3.97%,在单加速器上实现大规模剪枝。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08990 2026-01-01 cs.CR cs.AI cs.CL 73%

Effective and Efficient Jailbreaks of Black-Box LLMs with Cross-Behavior Attacks

对黑盒大语言模型进行高效有效的跨行为攻击

Vasudev Gohil

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种高效的黑盒LLM劫持方法,通过跨行为攻击显著提高攻击效率和成功率,同时减少查询次数并展示良好的迁移能力。

Comments Code is at https://github.com/gohil-vasudev/JCB

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00414 2026-01-01 cs.CL 70%

Semantic Parsing with Candidate Expressions for Knowledge Base Question Answering

基于候选表达式的语义解析用于知识库问答

Daehwan Nam, Gary Geunbae Lee

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于候选表达式增强的语义解析器,用于知识库问答,通过引入子类型推断和联合类型规则提升解析效率和准确性。

Journal ref Expert Syst. Appl. 306 (2026) 130564

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24687 2026-01-01 quant-ph cs.CL 70%

Quantum Visual Word Sense Disambiguation: Unraveling Ambiguities Through Quantum Inference Model

量子视觉词义消歧:通过量子推理模型解开歧义

Wenbo Qiao, Peng Zhang, Qinghua Hu

机构 * School of New Media and Communication, Tianjin University(天津大学新媒体与传播学院) College of Intelligence and Computing, Tianjin University(天津大学智能与计算学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出量子推理模型用于视觉词义消歧,通过量子叠加态缓解语义偏见,实验显示优于经典方法,尤其利用大语言模型非专业词义提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24157 2026-01-01 cs.CL 70%

Training Report of TeleChat3-MoE

TeleChat3-MoE训练报告

Xinzhang Liu, Chao Wang, Zhihao Yang, Zhuo Jiang, Xuncheng Zhao, Haoran Wang, Lei Li, Dongdong He, Luobin Liu, Kaizhe Yuan, Han Gao, Zihan Wang, Yitong Yao, Sishi Xiong, Wenmin Deng, Haowei He, Kaidong Yu, Yu Zhao, Ruiyu Fang, Yuhao Jiang, Yingyan Li, Xiaohui Hu, Xi Yu, Jingqi Li, Yanwei Liu, Qingli Li, Xinyu Shi, Junhao Niu, Chengnuo Huang, Yao Xiao, Ruiwen Wang, Fengkai Li, Luwen Pu, Kaipeng Jia, Fubei Yao, Yuyao Huang, Xuewei He, Zhuoru Jiang, Ruiting Song, Rui Xue, Qiyi Xie, Jie Zhang, Zilu Huang, Zhaoxi Zhang, Zhilong Lu, Yanhan Zhang, Yin Zhang, Yanlei Xue, Zhu Yuan, Teng Su, Xin Jiang, Shuangyong Song, Yongxiang Li, Xuelong Li

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 TeleChat3-MoE通过混合专家架构和优化的并行化框架,实现了大规模语言模型的高效训练与扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03183 2026-01-01 cs.CV cs.LG 70%

MaxInfo: A Training-Free Key-Frame Selection Method Using Maximum Volume for Enhanced Video Understanding

MaxInfo: 一种基于最大体积的无训练关键帧选择方法以提升视频理解

Pengyi Li, Irina Abdullaeva, Alexander Gambashidze, Andrey Kuznetsov, Ivan Oseledets

机构 * AXXX, Russia(AXXX, 俄罗斯) FusionBrain Lab, Russia(融合脑实验室, 俄罗斯) Institute of Numerical Mathematics, Russia(数值数学研究所, 俄罗斯) Innopolis University, Russia(因诺波利斯大学, 俄罗斯)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 MaxInfo是一种基于最大体积原理的无训练关键帧选择方法,通过提升视频理解性能,有效减少冗余并保持多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22251 2026-01-01 cs.LG cs.AI 62%

Interpretable Perturbation Modeling Through Biomedical Knowledge Graphs

通过生物医学知识图谱进行可解释的扰动建模

Pascal Passigan, Kevin Zhu, Angelina Ning

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于生物医学知识图谱的可解释扰动建模方法,通过整合多模态嵌入和图注意力网络,提升对药物-细胞对基因表达扰动的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24708 2026-01-01 cs.LG cs.AI 62%

BandiK: Efficient Multi-Task Decomposition Using a Multi-Bandit Framework

BandiK:使用多老虎机框架实现高效的多任务分解

András Millinghoffer, András Formanek, András Antos, Péter Antal

机构 * Department of Artificial Intelligence and Systems Engineering, Faculty of Electrical Engineering and Informatics, Budapest University of Technology and Economics(人工智能与系统工程系,电气工程与信息学院,布达佩斯技术大学和经济学院) Department of Electrical Engineering (ESAT), STADIUS Center for Dynamical Systems, Signal Processing(电气工程系(ESAT),动态系统、信号处理中心)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 BandiK通过多老虎机框架高效解决多任务学习中辅助任务子集选择问题,利用神经网络实现多任务转移优化。

Comments 8 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24866 2026-01-01 cs.LG 57%

Characterization of Transfer Using Multi-task Learning Curves

使用多任务学习曲线表征迁移

András Millinghoffer, Bence Bolgár, Péter Antal

机构 * Department of Artificial Intelligence and Systems Engineering(人工智能与系统工程系) Faculty of Electrical Engineering and Informatics(电气工程与信息学系) Budapest University of Technology and Economics(布达佩斯技术与经济大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文通过多任务学习曲线分析迁移效应,提出了一种高效方法以捕捉迁移效果,并展示了其在基础模型中的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24634 2026-01-01 nlin.PS cs.LG cs.NA math.AP math.NA 57%

Soliton profiles: Classical Numerical Schemes vs. Neural Network - Based Solvers

孤子剖面:经典数值方案与基于神经网络的求解器

Chandler Haight, Svetlana Roudenko, Zhongming Wang

机构 * Department of Mathematics \& Statistics, Florida International University, Miami, FL 33199, USA

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 本文比较了经典数值方法与基于神经网络的求解器在计算一维色散PDE孤子剖面中的性能,发现经典方法在精度和效率上更优,而神经网络方法在低维情况下表现较差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24461 2026-01-01 cs.AI 57%

Align While Search: Belief-Guided Exploratory Inference for World-Grounded Embodied Agents

对齐而搜索:基于信念的探索性推理用于世界感知的具身智能体

Seohui Bae, Jeonghye Kim, Youngchul Sung, Woohyung Lim

机构 * LG AI Research(LG人工智能研究) KAIST(韩国科学技术院)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

AI总结 本文提出了一种基于信念的探索性推理方法,通过后验引导和轻量级模型实现高效的世界对齐,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23165 2026-01-01 cs.LG 57%

Evaluating Parameter Efficient Methods for RLVR

评估用于RLVR的参数高效方法

Qingyu Yin, Yulun Wu, Zhennan Shen, Sunbowen Li, Zhilin Wang, Yanshu Li, Chak Tou Leong, Jiale Kang, Jinjin Gu

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本研究评估了RLVR中多种参数高效微调方法,发现结构变体如DoRA优于LoRA,并揭示了初始化策略中的谱崩溃现象及参数减少对推理能力的限制。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10973 2026-01-01 cs.CV cs.AI 57%

ExPLoRA: Parameter-Efficient Extended Pre-Training to Adapt Vision Transformers under Domain Shifts

ExPLoRA: 低参数高效扩展预训练以适应视觉变换器下的领域偏移

Samar Khanna, Medhanie Irgau, David B. Lobell, Stefano Ermon

机构 * stanford(斯坦福大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 ExPLoRA通过扩展预训练阶段并结合LoRA技术,在领域偏移下提升视觉变换器的迁移学习性能。

Comments Published at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18508 2026-01-01 cs.LG 57%

Orchid: Flexible and Data-Dependent Convolution for Sequence Modeling

Orchid: 灵活且数据依赖的卷积用于序列建模

Mahdi Karami, Ali Ghodsi

机构 * Google Research(谷歌研究) School of Computer Science University of Waterloo(计算机科学学院)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 Orchid提出了一种灵活且数据依赖的卷积架构,用于提升序列建模的效率和可扩展性。

Journal ref Advances in Neural Information Processing Systems 37 (2024): 76991-77022

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20143 2026-01-01 cs.CL cs.AI cs.IR 54%

SEDA: A Self-Adapted Entity-Centric Data Augmentation for Boosting Gird-based Discontinuous NER Models

SEDA: 一种自适应实体中心数据增强以提升基于网格的不连续命名实体识别模型

Wen-Fang Su, Hsiao-Wei Chou, Wen-Yang Lin

专题命中 效率与部署 :分类 cs.CL、cs.AI;large language model(comments);language model(comments)

AI总结 SEDA通过自适应实体中心数据增强技术,提升基于网格的不连续命名实体识别模型性能,实现不连续实体识别的显著提升。

Comments 9 pages, 5 figures. This paper was presented at the CIKM'25 Workshop on Small and Efficient Large Language Models for Knowledge Extraction

详情

展开后加载摘要…

URL PDF HTML 收藏