arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-14 至 2025-10-14 共收录 63 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 63 篇

2505.14871 2025-10-14 cs.CL cs.LG 92%

Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models

Ryan Solgi, Kai Zhen, Rupak Vignesh Swaminathan, Nathan Susanj, Athanasios Mouchtaris, Siegfried Kunzmann, Zheng Zhang

机构 * University of California-Santa Barbara(加州大学圣巴巴拉分校) Amazon(亚马逊)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);pretraining(abstract)

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24293 2025-10-14 cs.LG cs.AI cs.CL 90%

Equivalent Linear Mappings of Large Language Models

James R. Golden

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments title changed; major revisions; code available at https://github.com/jamesgolden1/equivalent-linear-LLMs/; published at https://openreview.net/forum?id=oDWbJsIuEp

Journal ref Transactions on Machine Learning Research (TMLR) (10/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01951 2025-10-14 cs.CL cs.LG 90%

Self-ensemble: Mitigating Confidence Mis-calibration for Large Language Models

Zicheng Xu, Guanchu Wang, Guangyao Zheng, Yu-Neng Chuang, Alexander Szalay, Xia Hu, Vladimir Braverman

机构 * Rice University(里士大学) University of North Carolina at Charlotte(北卡罗来纳州立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11211 2025-10-14 cs.DC 89%

An Explorative Study on Distributed Computing Techniques in Training and Inference of Large Language Models

Sheikh Azizul Hakim, Saem Hasan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10561 2025-10-14 eess.SP 89%

Large Language Model-Empowered Channel Prediction and Predictive Beamforming for LEO Satellite Communications

Zhixiong Chen, Hyundong Shin, Arumugam Nallanathan, Jonathon Chambers

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 14 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12450 2025-10-14 cs.CL 88%

Language Surgery in Multilingual Large Language Models

Joanito Agili Lopo, Muhammad Ravi Shulthan Habibi, Tack Hwa Wong, Muhammad Ilham Ghozali, Fajri Koto, Genta Indra Winata, Peerat Limkonchotiwat, Alham Fikri Aji, Samuel Cahyawijaya

机构 * SEACrowd Kreasof AI Universitas Indonesia(印度尼西亚大学) MBZUAI Capital One AI Singapore(AI新加坡) Cohere

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01668 2025-10-14 cs.CR cs.SE 88%

LineBreaker: Finding Token-Inconsistency Bugs with Large Language Models

Hongbo Chen, Yifan Zhang, Xing Han, Tianhao Mao, Huanyao Rong, Yuheng Zhang, XiaoFeng Wang, Luyi Xing, Xun Chen, Hang Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

Comments ASE 2025 Accepted, with Appendix added

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10618 2025-10-14 cs.CL 87%

Preserving LLM Capabilities through Calibration Data Curation: From Analysis to Optimization

Bowei He, Lihao Yin, Huiling Zhen, Shuqi Liu, Han Wu, Xiaokun Zhang, Mingxuan Yuan, Chen Ma

机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Huawei(华为)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10136 2025-10-14 cs.LG cs.AI 87%

PermLLM: Learnable Channel Permutation for N:M Sparse Large Language Models

Lancheng Zou, Shuo Yin, Zehua Pei, Tsung-Yi Ho, Farzan Farnia, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(title);language model(title);post-training(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14788 2025-10-14 cs.LG cs.AI cs.CL 87%

Designing Algorithms Empowered by Language Models: An Analytical Framework, Case Studies, and Insights

Yanxi Chen, Yaliang Li, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments TMLR camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11498 2025-10-14 cs.LG cs.CL 86%

ReLook: Vision-Grounded RL with a Multimodal LLM Critic for Agentic Web Coding

Yuhang Li, Chenchen Zhang, Ruilin Lv, Ao Liu, Ken Deng, Yuanxing Zhang, Jiaheng Liu, Wiggin Zhou, Bo Zhou

机构 * LLM Department, Tencent(腾讯大语言模型部门) Peking University(北京大学) Nanjing University(南京大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10739 2025-10-14 cs.LG cs.AI cs.SE 86%

A Stochastic Differential Equation Framework for Multi-Objective LLM Interactions: Dynamical Systems Analysis with Code Generation Applications

Shivani Shukla, Himanshu Joshi

机构 * University of San Francisco(旧金山大学) Vector Institute for Artificial Intelligence(人工智能向量研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Peer-reviewed and accepted to the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) DynaFront 2025 Workshop (https://sites.google.com/view/dynafrontneurips25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25279 2025-10-14 cs.AI cs.DC cs.LG 86%

RL in the Wild: Characterizing RLVR Training in LLM Deployment

Jiecheng Zhou, Qinghao Hu, Yuyang Jin, Zerui Wang, Peng Sun, Yuzhe Gu, Wenwei Zhang, Mingshu Zhai, Xingcheng Zhang, Weiming Zhang

机构 * USTC(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) NTU(国立台湾大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 28 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19274 2025-10-14 cs.LG cs.AI cs.OS cs.PF 86%

Neuralink: Fast LLM Inference on Smartphones with Neuron Co-Activation Linking

Tuowei Wang, Ruwen Fan, Minxing Huang, Zixu Hao, Kun Li, Ting Cao, Youyou Lu, Yaoxue Zhang, Ju Ren

机构 * Tsinghua University(清华大学) Tianjin University(天津大学) Microsoft Research(微软研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the 30th ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Vol. 3, Rotterdam, Netherlands, 2025, pp. 147-162

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09852 2025-10-14 cs.LG cs.AI 86%

ProxRouter: Proximity-Weighted LLM Query Routing for Improved Robustness to Outliers

Shivam Patel, Neharika Jali, Ankur Mallick, Gauri Joshi

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft(微软公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01249 2025-10-14 cs.SE cs.PF 86%

SysLLMatic: Large Language Models are Software System Optimizers

Huiyun Peng, Arjun Gupte, Ryan Hasler, Nicholas John Eliopoulos, Chien-Chou Ho, Rishi Mantri, Leo Deng, Konstantin Läufer, George K. Thiruvathukal, James C. Davis

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10849 2025-10-14 cs.LG 85%

Glance for Context: Learning When to Leverage LLMs for Node-Aware GNN-LLM Fusion

Donald Loveland, Yao-An Yang, Danai Koutra

机构 * Department of Computer Science and Engineering University of Michigan(计算机科学与工程系 密歇根大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23841 2025-10-14 cs.IR cs.CL 85%

SkewRoute: Training-Free LLM Routing for Knowledge Graph Retrieval-Augmented Generation via Score Skewness of Retrieved Context

Hairu Wang, Yuan Feng, Yukun Cao, Xike Xie, S Kevin Zhou

机构 * School of Computer Science, University of Science and Technology of China(中国科学技术大学计算机科学学院) School of Biomedical Engineering, USTC(USTC生物医学工程学院) Suzhou Institute for Advanced Reasearch, USTC(USTC苏州市先进研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09942 2025-10-14 cs.LG cs.AI cs.IT math.IT 85%

Conformal Sparsification for Bandwidth-Efficient Edge-Cloud Speculative Decoding

Payel Bhattacharjee, Fengwei Tian, Meiyu Zhong, Guangyi Zhang, Osvaldo Simeone, Ravi Tandon

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系;亚利桑那大学;美国亚利桑那州图森) University of Arizona(信息科学与电子工程学院;浙江大学;中国杭州310027) Tucson, AZ, USA(工程系;伦敦国王学院;英国伦敦) College of Information Science and Electronic Engineering, Zhejiang University, Hangzhou 310027, China Department of Engineering King’s College London London, UK

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI and ML for Next-Generation Wireless Communications and Networking (AI4NextG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09722 2025-10-14 cs.CL cs.AI cs.CV 85%

Layout-Aware Parsing Meets Efficient LLMs: A Unified, Scalable Framework for Resume Information Extraction and Evaluation

Fanwei Zhu, Jinke Yu, Zulong Chen, Ying Zhou, Junhao Ji, Zhibo Yang, Yuxue Zhang, Haoyuan Hu, Zhenghao Liu

机构 * Hangzhou City University(杭州市大学) Alibaba Group(阿里巴巴集团) Zhejiang Lab(浙江实验室) Alibaba Cloud(阿里云) Northeastern University(东北大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11331 2025-10-14 eess.SY cs.SY 85%

Efficient LLM Inference over Heterogeneous Edge Networks with Speculative Decoding

Bingjie Zhu, Zhixiong Chen, Liqiang Zhao, Hyundong Shin, Arumugam Nallanathan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18846 2025-10-14 cs.CR 85%

LLM-Driven APT Detection for 6G Wireless Networks: A Systematic Review and Taxonomy

Muhammed Golec, Yaser Khamayseh, Suhib Bani Melhem, Abdulmalik Alwarafy

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 22 pages, 11 figures, 8 tables. Submitted to Computer Science Review (Elsevier), May 2025

Journal ref IEEE Access 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09981 2025-10-14 cs.CV eess.IV 85%

Scaling Traffic Insights with AI and Language Model-Powered Camera Systems for Data-Driven Transportation Decision Making

Fan Zuo, Donglin Zhou, Jingqin Gao, Kaan Ozbay

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11615 2025-10-14 cs.CL cs.AI 84%

LLM-Oriented Token-Adaptive Knowledge Distillation

Xurong Xie, Zhucun Xue, Jiafu Wu, Jian Li, Yabiao Wang, Xiaobin Hu, Yong Liu, Jiangning Zhang

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10138 2025-10-14 cs.CL cs.AI 84%

Hybrid OCR-LLM Framework for Enterprise-Scale Document Information Extraction Under Copy-heavy Task

Zilong Wang, Xiaoyu Shen

机构 * Ningbo Institute of Digital Twin(宁波数字孪生研究所) Eastern Institute of Technology(东部技术研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10885 2025-10-14 cs.CL cs.DB 81%

Rethinking Agentic Workflows: Evaluating Inference-Based Test-Time Scaling Strategies in Text2SQL Tasks

Jiajing Guo, Kenil Patel, Jorge Piazentin Ono, Wenbin He, Liu Ren

机构 * Bosch Research North America, USA(博世美国研究北美洲) Bosch Center for Artificial Intelligence (BCAI)(博世人工智能中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at COLM 2025 SCALR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14019 2025-10-14 cs.AI cs.AR cs.PL 80%

ChipGPT: How far are we from natural language hardware design

Kaiyan Chang, Ying Wang, Haimeng Ren, Mengdi Wang, Shengwen Liang, Yinhe Han, Huawei Li, Xiaowei Li

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences, China(处理器国家重点实验室,计算技术研究所,中国科学院,中国) University of Chinese Academy of Sciences(中国科学院大学) School of Information Science and Technology, ShanghaiTech University, China(信息科学与技术学院,上海科技大学,中国)

专题命中 效率与部署 :LLM(abstract,comments);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI

Comments Accepted by 2023 NeurIPS SysML Workshop, retitled to "Improving Large Language Model Hardware Generating Quality through Post-LLM Search"

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01092 2025-10-14 cs.CL cs.AI cs.LG 80%

REFRAG: Rethinking RAG based Decoding

Xiaoqiang Lin, Aritra Ghosh, Bryan Kian Hsiang Low, Anshumali Shrivastava, Vijai Mohan

机构 * Meta Superintelligence Labs(Meta超智能实验室) National University of Singapore(新加坡国立大学) Rice University(Rice大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments fix typo perplexity->log perplexity; added recent papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16743 2025-10-14 cs.CL cs.AI cs.LG 80%

TRIM: Achieving Extreme Sparsity with Targeted Row-wise Iterative Metric-driven Pruning

Florentin Beck, William Rudman, Carsten Eickhoff

机构 * University of Tübingen, School of Medicine(图宾根大学医学院) University of Texas at Austin, Department of Linguistics(德克萨斯大学奥斯汀分校语言学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10663 2025-10-14 cs.CV cs.AI 79%

Scalable Face Security Vision Foundation Model for Deepfake, Diffusion, and Spoofing Detection

Gaojian Wang, Feng Lin, Tong Wu, Zhisheng Yan, Kui Ren

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

Comments 18 pages, 9 figures, project page: https://fsfm-3c.github.io/fsvfm.html

详情

展开后加载摘要…

URL PDF HTML 收藏