arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-01 至 2025-10-01 共收录 274 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 52 篇

2509.11662 2025-10-01 cs.CV cs.AI cs.CL eess.IV 88%

MindVL: Towards Efficient and Effective Training of Multimodal Large Language Models on Ascend NPUs

Feilong Chen, Yijiang Liu, Yi Huang, Hao Wang, Miren Tian, Ya-Qi Yu, Minghui Liao, Jihao Wu

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26482 2025-10-01 cs.AI 88%

TVS Sidekick: Challenges and Practical Insights from Deploying Large Language Models in the Enterprise

Paula Reyero Lobo, Kevin Johnson, Bill Buchanan, Matthew Shardlow, Ashley Williams, Samuel Attwood

机构 * TVS Supply Chain Solutions(TVS供应链解决方案) Manchester Metropolitan University(曼彻斯特 Metropolitan 大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted at EthicalLLMs@RANLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20873 2025-10-01 cs.CV 88%

Fork-Merge Decoding: Enhancing Multimodal Understanding in Audio-Visual Large Language Models

Chaeyoung Jung, Youngjoon Jang, Jongmin Choi, Joon Son Chung

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26200 2025-10-01 cs.NI cs.AI 85%

Toward an Unbiased Collective Memory for Efficient LLM-Based Agentic 6G Cross-Domain Management

Hatim Chergui, Miguel Catalan Cid, Pouria Sayyad Khodashenas, Daniel Camps Mur, Christos Verikoukis

机构 * i2CAT Foundation(i2CAT基金会) ISI/ATH University of Patras(帕特拉大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25919 2025-10-01 cs.DC cs.AI 85%

Accelerating LLM Inference with Precomputed Query Storage

Jay H. Park, Youngju Cho, Choungsol Lee, Moonwook Oh, Euiseong Seo

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14043 2025-10-01 cs.LG 85%

Beyond Next Token Probabilities: Learnable, Fast Detection of Hallucinations and Data Contamination on LLM Output Distributions

Guy Bar-Shalom, Fabrizio Frasca, Derek Lim, Yoav Gelberg, Yftah Ziser, Ran El-Yaniv, Gal Chechik, Haggai Maron

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00741 2025-10-01 cs.AI cs.AR cs.DC 85%

DynamoLLM: Designing LLM Inference Clusters for Performance and Energy Efficiency

Jovan Stojkovic, Chaojie Zhang, Íñigo Goiri, Josep Torrellas, Esha Choukse

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft Azure Research - Systems(微软Azure研究-系统)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25803 2025-10-01 cs.IR cs.AI cs.CE cs.LG 85%

Better with Less: Small Proprietary Models Surpass Large Language Models in Financial Transaction Understanding

Wanying Ding, Savinay Narendra, Xiran Shi, Adwait Ratnaparkhi, Chengrui Yang, Nikoo Sabzevar, Ziyan Yin

机构 * JPMorgan Chase & Co.(摩根大通公司)

专题命中 效率与部署 :large language model(title);language model(title);分类 cs.AI、cs.LG

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26182 2025-10-01 cs.DC 85%

Parallax: Efficient LLM Inference Service over Decentralized Environment

Chris Tong, Youhe Jiang, Gufeng Chen, Tianyi Zhao, Sibian Lu, Wenjie Qu, Eric Yang, Lynn Ai, Binhang Yuan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25853 2025-10-01 cs.AR 85%

SAIL: SRAM-Accelerated LLM Inference System with Lookup-Table-based GEMV

Jingyao Zhang, Jaewoo Park, Jongeun Lee, Elaheh Sadredini

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18628 2025-10-01 cs.LG cs.CL 84%

Hardware-Aware Parallel Prompt Decoding for Memory-Efficient Acceleration of LLM Inference

Hao Mark Chen, Wayne Luk, Ka Fai Cedric Yiu, Rui Li, Konstantin Mishchenko, Stylianos I. Venieris, Hongxiang Fan

机构 * Imperial College London, UK(伦敦帝国学院) Hong Kong Polytechnic University, Hong Kong(香港理工大学) Samsung AI Center, Cambridge, UK(三星人工智能中心)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at EMNLP 2025. The code for this implementation is available at https://github.com/hmarkc/parallel-prompt-decoding

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25267 2025-10-01 cs.LG cs.AI cs.CL 83%

Dynamic Policy Induction for Adaptive Prompt Optimization: Bridging the Efficiency-Accuracy Gap via Lightweight Reinforcement Learning

Jiexi Xu

机构 * University of California, Irvine School of Information & Computer Science(加州大学尔湾分校信息与计算机科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 13 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26328 2025-10-01 cs.CL 83%

Fast-dLLM v2: Efficient Block-Diffusion LLM

Chengyue Wu, Hao Zhang, Shuchen Xue, Shizhe Diao, Yonggan Fu, Zhijian Liu, Pavlo Molchanov, Ping Luo, Song Han, Enze Xie

机构 * The University of Hong Kong(香港大学) NVIDIA(英伟达) MIT(麻省理工学院)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26246 2025-10-01 cs.AI 83%

SlimPack: Fine-Grained Asymmetric Packing for Balanced and Efficient Variable-Length LLM Training

Yuliang Liu, Guohao Wu, Shenglong Zhang, Wei Zhang, Qianchao Zhu, Zhouyang Li, Chenyu Wang

机构 * Kling Infra, Kuaishou Technology(Kling Infra,快手科技)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25238 2025-10-01 cs.LG cs.AI 81%

PALADIN: Self-Correcting Language Model Agents to Cure Tool-Failure Cases

Sri Vatsa Vuddanti, Aarav Shah, Satwik Kumar Chittiprolu, Tony Song, Sunishchal Dev, Kevin Zhu, Maheep Chaudhary

专题命中 效率与部署 :language model(title);language agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07675 2025-10-01 cs.LG cs.AI cs.CV 81%

Simple yet Effective Semi-supervised Knowledge Distillation from Vision-Language Models via Dual-Head Optimization

Seongjae Kang, Dong Bok Lee, Hyungjoon Jang, Sung Ju Hwang

机构 * VUNO Inc.(VUNO公司) KAIST(韩国科学技术院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

Comments 38 pages, 17 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26124 2025-10-01 cs.CL 79%

Vocabulary Customization for Efficient Domain-Specific LLM Deployment

Christian Herold, Michael Kozielski, Nicholas Santavas, Yannick Versley, Shahram Khadivi

机构 * eBay Inc(eBay公司)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL

Comments Accepted at NEURIPS 2025 CCFM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07448 2025-10-01 cs.AI 79%

Efficient Dynamic Ensembling for Multiple LLM Experts

Jinwu Hu, Yufeng Wang, Shuhai Zhang, Kai Zhou, Guohao Chen, Yu Hu, Bin Xiao, Mingkui Tan

机构 * South China University of Technology(华南理工大学) Pazhou Laboratory(琶洲实验室) Peng Cheng Laboratory(鹏城实验室) Hong Kong Polytechnic University(香港理工大学) Chongqing University of Posts and Telecommunications(重庆邮电大学) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26436 2025-10-01 cs.CV 78%

Post-Training Quantization via Residual Truncation and Zero Suppression for Diffusion Models

Donghoon Kim, Dongyoung Lee, Ik Joon Chang, Sung-Ho Bae

机构 * Department of Artificial Intelligence(人工智能系) Kyung Hee University(庆尚大学) Department of Electrical Engineering(电气工程系) Department of Computer Science(计算机科学系)

专题命中 效率与部署 :post-training(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25808 2025-10-01 cs.LG 77%

Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse

Yuheng Zhang, Wenlin Yao, Changlong Yu, Yao Liu, Qingyu Yin, Bing Yin, Hyokun Yun, Lihong Li

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25712 2025-10-01 cs.LG 77%

Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking

Dengming Zhang, Xiaowen Ma, Zhenliang Ni, Zhenkai Wu, Han Shu, Xin Jiang, Xinghao Chen

机构 * Zhejiang University(浙江大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22502 2025-10-01 cs.AI cs.HC 77%

InfiAgent: Self-Evolving Pyramid Agent Framework for Infinite Scenarios

Chenglin Yu, Yang Yu, Songmiao Wang, Yucheng Wang, Yifan Yang, Jinjia Li, Ming Li, Hongxia Yang

机构 * The Hong Kong University(香港大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 9 pages of main content and 32 pages of others, 2 figures, under review as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25709 2025-10-01 econ.EM 75%

Leveraging LLMs to Improve Experimental Design: A Generative Stratification Approach

George Gui, Seungwoo Kim

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02780 2025-10-01 cs.SE 75%

EfficientEdit: Accelerating Code Editing via Edit-Oriented Speculative Decoding

Peiding Wang, Li Zhang, Fang Liu, Yinghao Zhu, Wang Xu, Lin Shi, Xiaoli Lian, Minxiao Li, Bo Shen, An Fu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26628 2025-10-01 cs.LG cs.CL 73%

Attention as a Compass: Efficient Exploration for Process-Supervised RL in Reasoning Models

Runze Liu, Jiakang Wang, Yuling Shi, Zhihui Xie, Chenxin An, Kaiyan Zhang, Jian Zhao, Xiaodong Gu, Lei Lin, Wenping Hu, Xiu Li, Fuzheng Zhang, Guorui Zhou, Kun Gai

机构 * Tsinghua University(清华大学) Kuaishou Technology(快手科技) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25958 2025-10-01 cs.AI cs.CL 73%

RoRecomp: Enhancing Reasoning Efficiency via Rollout Response Recomposition in Reinforcement Learning

Gang Li, Yulei Qin, Xiaoyu Tan, Dingkang Yang, Yuchen Shi, Zihan Xu, Xiang Li, Xing Sun, Ke Li

机构 * Tencent Youtu Lab(腾讯优图实验室) Fudan Univeristy(复旦大学) Nankai University(南开大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25689 2025-10-01 cs.AI cs.LG 73%

Collaborative Compression for Large-Scale MoE Deployment on Edge

Yixiao Chen, Yanyue Xie, Ruining Yang, Wei Jiang, Wei Wang, Yong He, Yue Chen, Pu Zhao, Yanzhi Wang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13115 2025-10-01 cs.CL cs.AI cs.CR 73%

Dagger Behind Smile: Fool LLMs with a Happy Ending Story

Xurui Song, Zhixin Xie, Shuo Huai, Jiayi Kong, Jun Luo

机构 * S-Lab, Nanyang Technological University, Singapore(南洋理工大学新加坡分校S实验室) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01503 2025-10-01 cs.NI 71%

A Highly Scalable LLM Clusters with Optical Interconnect

Xinchi Han, Yongxi Lv, Weihao Jiang, Shuyuan Zhang, Yingming Mao, Shizhen Zhao, ZhuoRan Liu, Zhuotao Liu, Peirui Cao, Ximeng Liu, Xinbing Wang

专题命中 效率与部署 :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26534 2025-10-01 cs.AI cs.AR cs.DC 70%

Rearchitecting Datacenter Lifecycle for AI: A TCO-Driven Framework

Jovan Stojkovic, Chaojie Zhang, Íñigo Goiri, Ricardo Bianchini

机构 * University of Illinois Urbana-Champaign, USA(伊利诺伊大学厄巴纳-香槟分校) Microsoft Azure Research(微软Azure研究院) Microsoft Azure(微软Azure)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏