arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-26 至 2025-11-26 共收录 35 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 35 篇

2410.13334 2025-11-26 cs.CL cs.AI cs.LG 90%

BiasJailbreak:Analyzing Ethical Biases and Jailbreak Vulnerabilities in Large Language Models

BiasJailbreak: 分析大型语言模型中的伦理偏见和 jailbreak 漏洞

Isack Lee, Haebin Seong

机构 * Theori Inc.(Theori公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究分析了大型语言模型中的伦理偏见和 jailbreak 漏洞,提出 BiasJailbreak 和 BiasDefense 方法以提高模型安全性。

Comments Accepted as a workshop paper at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19495 2025-11-26 cs.LG cs.AI 88%

A Systematic Study of Compression Ordering for Large Language Models

大语言模型压缩顺序的系统研究

Shivansh Chhawri, Rahul Mahadik, Suparna Rooj

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究系统探讨了大语言模型压缩技术的顺序对性能的影响,发现剪枝-知识蒸馏-量化顺序能实现3.68倍压缩并保持良好能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19648 2025-11-26 cs.CL cs.AI 86%

Efficient Multi-Hop Question Answering over Knowledge Graphs via LLM Planning and Embedding-Guided Search

通过LLM规划和嵌入引导搜索实现高效的多跳知识图谱问答

Manil Shrestha, Edward Kim

机构 * Department of Computer Science, Drexel University, Philadelphia, PA, USA(计算机科学系,德雷塞尔大学,费城,宾夕法尼亚州,美国)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出两种混合算法,通过LLM规划和嵌入引导搜索实现高效且可验证的多跳知识图谱问答,提升推理效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19496 2025-11-26 cs.LG cs.AI 86%

Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM

Xmodel-2.5: 1.3B数据高效推理SLM

Yang Liu, Xiaolong Zhong, Ling Jiang

机构 * Xiaoduo AI Lab(小多人工智能实验室)

专题命中 效率与部署 :SLM(title);large language model(abstract);language model(abstract);small language model(abstract)

AI总结 Xmodel-2.5通过最大更新参数化和混合精度训练,实现了1.3B参数高效推理模型,提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15815 2025-11-26 cs.AI 85%

Attention Pruning: Automated Fairness Repair of Language Models via Surrogate Simulated Annealing

注意力剪枝:通过代理模拟退火实现语言模型的自动公平性修复

Vishnu Asutosh Dasu, Md Rafi ur Rashid, Vipul Gupta, Saeid Tizpaz-Niari, Gang Tan

机构 * Pennsylvania State University(宾夕法尼亚州立大学) University of Illinois(伊利诺伊大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

AI总结 本文提出注意力剪枝方法,通过代理模拟退火在LLMs中减少偏见,提升公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19483 2025-11-26 cs.SE cs.AI 85%

Z-Space: A Multi-Agent Tool Orchestration Framework for Enterprise-Grade LLM Automation

Z-Space:面向企业级LLM自动化的一种多智能体工具协调框架

Qingsong He, Jing Nan, Jiayu Jiao, Liangjie Tang, Xiaodong Xu, Mengmeng Sun, Qingyao Wang, Minghui Yan

机构 * Rajax Network Technology (ele.me)(Rajax网络技术(ele.me))

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Z-Space通过多智能体协作框架提升企业级LLM自动化工具调用效率与准确性

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14909 2025-11-26 cs.LG cs.AI cs.CL 85%

Mixture of Attention Spans: Optimizing LLM Inference Efficiency with Heterogeneous Sliding-Window Lengths

注意力跨度混合:通过异质滑动窗口长度优化LLM推理效率

Tianyu Fu, Haofeng Huang, Xuefei Ning, Genghan Zhang, Boju Chen, Tianqi Wu, Hongyi Wang, Zixiao Huang, Shiyao Li, Shengen Yan, Guohao Dai, Huazhong Yang, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence-AI Stanford University(斯坦福大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MoA通过异质滑动窗口长度优化LLM推理效率,提升上下文长度和检索准确率,减少内存消耗并提高吞吐量。

Comments Published at CoLM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19523 2025-11-26 cs.CR 85%

EAGER: Edge-Aligned LLM Defense for Robust, Efficient, and Accurate Cybersecurity Question Answering

EAGER: 边缘对齐的LLM防御方法用于鲁棒、高效且准确的网络安全问答

Onat Gungor, Roshan Sood, Jiasheng Zhou, Tajana Rosing

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 EAGER通过参数高效量化与领域偏好对齐,提升网络安全问答的鲁棒性、效率和准确性,降低对抗攻击成功率并优化响应延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18428 2025-11-26 cs.AI cs.CL 84%

Multi-Modal Data Exploration via Language Agents

通过语言代理进行多模态数据探索

Farhad Nooralahzadeh, Yi Zhang, Jonathan Furst, Kurt Stockinger

机构 * Zurich University of Applied Sciences(瑞士应用科学大学)

专题命中 效率与部署 :language agent(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出M$^2$EX系统,通过语言代理实现多模态数据探索,优于现有系统在准确性和性能指标上

Comments Accepted to the IJCNLP AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20340 2025-11-26 cs.CL 83%

Scaling LLM Speculative Decoding: Non-Autoregressive Forecasting in Large-Batch Scenarios

扩展大语言模型推测解码:在大批次场景中的非自回归预测

Luohe Shi, Zuchao Li, Lefei Zhang, Baoyuan Qi, Guoming Liu, Hai Zhao

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);分类 cs.CL

AI总结 SpecFormer通过整合单向和双向注意力机制,实现大批次场景下的高效LLM推理,降低训练和计算成本。

Comments accepted by AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19536 2025-11-26 cs.CR cs.AI 83%

AttackPilot: Autonomous Inference Attacks Against ML Services With LLM-Based Agents

AttackPilot: 基于大语言模型的自主推断攻击对抗ML服务

Yixin Wu, Rui Wen, Chi Cui, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全中心) Institute of Science Tokyo(东京科学研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AttackPilot利用大语言模型开发自主代理,实现无需人工干预的推断攻击,展现高任务完成率和低成本,有效提升非专家对ML服务风险评估的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20048 2025-11-26 cs.AI cs.LG cs.PF 81%

Reducing Latency of LLM Search Agent via Speculation-based Algorithm-System Co-Design

通过基于猜测的算法-系统联合设计降低LLM搜索代理的延迟

Zixiao Huang, Wen Zeng, Tianyu Fu, Tengxuan Liu, Yizhou Sun, Ke Hong, Xinhao Yang, Chengchun Liu, Yan Li, Quanlu Zhang, Guohao Dai, Zhenhua Zhu, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence Lenovo(联想) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 SPAgent通过基于猜测的算法-系统联合设计框架,减少LLM搜索代理的延迟,实现端到端加速并保持高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06836 2025-11-26 cs.CV cs.AI cs.LG 81%

Harnessing Vision-Language Models for Time Series Anomaly Detection

利用视觉语言模型进行时间序列异常检测

Zelin He, Sarah Alnegheimish, Matthew Reimherr

机构 * Amazon(亚马逊公司)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于视觉语言模型的两阶段方法,无需时间序列训练即可提升时间序列异常检测的准确性和效率。

Comments Accepted at AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20182 2025-11-26 cs.CL 79%

KyrgyzBERT: A Compact, Efficient Language Model for Kyrgyz NLP

KyrgyzBERT: 一种用于吉尔吉斯语NLP的紧凑高效语言模型

Adilet Metinov, Gulida M. Kudakeeva, Gulnara D. Kabaeva

机构 * Institute of Information Technology, Kyrgyz State Technical University named after I. Razzakov, Bishkek, Kyrgyzstan(信息技术学院,伊·拉扎科夫命名的吉尔吉斯国立技术大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 KyrgyzBERT是一种专为吉尔吉斯语设计的高效语言模型,通过情感分析基准测试实现了与更大模型相当的性能,推动了吉尔吉斯语NLP的发展。

Comments 3 pages, 1 figure, 2 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19822 2025-11-26 cs.LG cs.AI 79%

Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models

拼图剪枝:一种用于混合专家模型通用剪枝的分层框架

Wentao Hu, Mingkuan Zhao, Shuangyong Song, Xiaoyan Zhu, Xin Lai, Jiayin Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 拼图剪枝通过分层框架实现混合专家模型的通用剪枝,提升模型在多样化下游任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14528 2025-11-26 cs.CV 78%

PaddleOCR-VL: Boosting Multilingual Document Parsing via a 0.9B Ultra-Compact Vision-Language Model

PaddleOCR-VL: 通过0.9B超紧凑视觉-语言模型提升多语言文档解析

Cheng Cui, Ting Sun, Suyin Liang, Tingquan Gao, Zelun Zhang, Jiaxuan Liu, Xueqing Wang, Changda Zhou, Hongen Liu, Manhui Lin, Yue Zhang, Yubo Zhang, Handong Zheng, Jing Zhang, Jun Zhang, Yi Liu, Dianhai Yu, Yanjun Ma

机构 * PaddlePaddle Team, Baidu Inc.(百度公司)

专题命中 效率与部署 :language model(title,abstract)

AI总结 PaddleOCR-VL通过0.9B超紧凑视觉-语言模型实现多语言文档解析的高效准确识别

Comments Github Repo: https://github.com/PaddlePaddle/PaddleOCR

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19705 2025-11-26 cs.LG 77%

CafeQ: Calibration-free Quantization via Learned Transformations and Adaptive Rounding

CafeQ: 无需校准的量化方法通过学习变换和自适应四舍五入

Ziteng Sun, Adrian Benton, Samuel Kushnir, Asher Trockman, Vikas Singh, Suhas Diggavi, Ananda Theertha Suresh

机构 * Google(谷歌) University of Wisconsin Madison(威斯康星大学麦迪逊分校) University of California Los Angeles(加州大学洛杉矶分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.LG

AI总结 CafeQ通过学习变换和自适应四舍五入方法,在无需校准数据的情况下提升大语言模型的量化效果,实现更高效的推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20626 2025-11-26 cs.LG cs.AI 73%

ROOT: Robust Orthogonalized Optimizer for Neural Network Training

ROOT:神经网络训练的鲁棒正交优化器

Wei He, Kai Han, Hang Zhou, Hanting Chen, Zhicheng Liu, Xinghao Chen, Yunhe Wang

机构 * Huawei Noah's Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 ROOT通过双重鲁棒性机制提升神经网络训练稳定性,解决优化器在噪声和非凸场景中的鲁棒性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16274 2025-11-26 cs.LG cs.AI cs.DC cs.PF 73%

STAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning

STAlloc:通过时空规划提升大规模模型训练的内存效率

Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence AI Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 STAlloc通过结合离线规划与在线分配,有效减少大规模模型训练中的内存碎片化,提升训练效率和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19480 2025-11-26 cs.LG cs.AI 73%

Exploiting the Experts: Unauthorized Compression in MoE-LLMs

利用专家:MoE-LLMs中的未经授权压缩

Pinaki Prasad Guha Neogi, Ahmad Mohammadshirazi, Dheeraj Kulshrestha, Rajiv Ramnath

机构 * Ohio State University(俄亥俄州立大学) Flairsoft

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了MoE-LLMs在特定任务中的可剪枝性,提出专家归因框架和防御策略以防止未经授权的压缩和微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19676 2025-11-26 cs.CV 71%

INTERLACE: Interleaved Layer Pruning and Efficient Adaptation in Large Vision-Language Models

INTERLACE:大规模视觉-语言模型中的交错层剪枝与高效适应

Parsa Madinei, Ryan Solgi, Ziqi Wen, Jonathan Skaza, Miguel Eckstein, Ramtin Pedarsani

机构 * UC Santa Barbara(加州大学圣巴巴拉分校)

专题命中 效率与部署 :language model(title)

AI总结 INTERLACE通过交错微调冻结设计,在剪枝25%网络后实现88.9%的性能保留,达到SOTA水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19803 2025-11-26 cs.LG 70%

Scalable Data Attribution via Forward-Only Test-Time Inference

可扩展的数据归因 via 单向测试时推断

Sibo Ma, Julian Nyarko

机构 * Stanford University(斯坦福大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种通过单向测试时推断实现可扩展数据归因的方法,结合影响函数保真度与首阶可扩展性,降低推理成本并提升大规模应用效果。

Comments 8 pages. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19671 2025-11-26 cs.AI 70%

FISCAL: Financial Synthetic Claim-document Augmented Learning for Efficient Fact-Checking

FISCAL: 金融合成声明-文档增强学习用于高效事实核查

Rishab Sharma, Iman Saberi, Elham Alipour, Jie JW Wu, Fatemeh Fard

机构 * Charli Capital(Charli资本) University of British Columbia(不列颠哥伦比亚大学) Michigan Technological University(密歇根技术大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 FISCAL通过生成领域特定合成数据和高效微调,使小型模型在金融事实核查任务中达到最先进的准确性、鲁棒性和可扩展性。

Comments 3 tables, 11 pages, 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Generative AI in Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11177 2025-11-26 cs.CV 67%

Viper-F1: Fast and Fine-Grained Multimodal Understanding with Cross-Modal State-Space Modulation

Viper-F1:基于交叉模态状态空间调制的高效细粒度多模态理解

Quoc-Huy Trinh

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 Viper-F1通过引入高效液态状态空间动力学和令牌-网格相关模块,实现了高效细粒度多模态理解。

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03263 2025-11-26 physics.optics cs.ET cs.NE 67%

A 262 TOPS Hyperdimensional Photonic AI Accelerator powered by a Si3N4 microcomb laser

一种262 TOPS超维度光子AI加速器,由Si3N4微梳激光器驱动

Christos Pappas, Antonios Prapas, Theodoros Moschos, Manos Kirtas, Odysseas Asimopoulos, Apostolos Tsakyridis, Miltiadis Moralis-Pegios, Chris Vagionas, Nikolaos Passalis, Cagri Ozdilek, Timofey Shpakovsky, Alain Yuji Takabayashi, John D. Jost, Maxim Karpov, Anastasios Tefas, Nikos Pleros

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于Si3N4微梳激光器的262 TOPS超维度光子AI加速器,通过多维复用技术实现高计算能力,应用于DDoS检测和MNIST分类任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20621 2025-11-26 cs.LG cs.AI 62%

DiFR: Inference Verification Despite Nondeterminism

DiFR: 在非确定性中进行推理验证

Adam Karvonen, Daniel Reuter, Roy Rinberg, Luke Marks, Adrià Garriga-Alonso, Keri Warr

机构 * harvard(哈佛大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 DiFR通过比较生成token与可信参考实现预测,验证推理过程的正确性,能有效检测采样错误、模拟bug和模型量化,提升推理验证的效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16786 2025-11-26 cs.SE cs.AI cs.LG 62%

More with Less: An Empirical Study of Turn-Control Strategies for Efficient Coding Agents

更多但更少:一种关于高效编码代理的实证研究:回合控制策略

Pengfei Gao, Chao Peng

机构 * ByteDance(字节跳动)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文通过实证研究分析了编码代理的回合控制策略,发现动态资源分配在成本和效率之间取得平衡,优于固定回合限制方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19518 2025-11-26 cs.CV cs.AI cs.IT cs.LG math.IT 62%

Towards Efficient VLMs: Information-Theoretic Driven Compression via Adaptive Structural Pruning

迈向高效的VLMs:通过自适应结构压缩的信息论驱动压缩

Zhaoqi Xu, Yingying Zhang, Jian Li, Jianwei Guo, Qiannan Zhu, Hua Huang

机构 * School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Zhongtai Securities Institute for Financial Studies, Shandong University(山东大学中泰证券金融研究学院)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出InfoPrune框架,通过信息论驱动的自适应结构压缩方法,在保持性能的同时显著提升视觉语言模型的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19635 2025-11-26 cs.SE cs.LG 57%

Agint: Agentic Graph Compilation for Software Engineering Agents

Agint:软件工程代理的代理图编译

Abhi Chivukula, Jay Somasundaram, Vijay Somasundaram

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

AI总结 Agint通过代理图编译器和运行时实现高效、可靠的软件工程代理,支持自然语言到代码的自动化转换与协作开发。

Comments 18 pages, 5 figures, NeurIPS 2025: Deep Learning for Code in the Agentic Era

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02315 2025-11-26 cs.LG stat.ML 57%

Improving Constrained Language Generation via Self-Distilled Twisted Sequential Monte Carlo

通过自蒸馏扭曲序列蒙特卡洛改进约束语言生成

Sooyeon Kim, Giung Nam, Byoungwoo Park, Juho Lee

机构 * Seoul National University(首尔国立大学) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文通过自蒸馏扭曲序列蒙特卡洛方法改进约束语言生成,提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏