arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-30 至 2025-09-30 共收录 92 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 92 篇

2509.24488 2025-09-30 cs.CL cs.CR cs.LG 90%

Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models

Wenjie Fu, Huandong Wang, Junyao Gao, Guoan Wan, Tao Jiang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22921 2025-09-30 cs.LG cs.AI 90%

Rethinking Large Language Model Distillation: A Constrained Markov Decision Process Perspective

Matthieu Zimmer, Xiaotong Ji, Tu Nguyen, Haitham Bou Ammar

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Huawei R&D Munich(华为慕尼黑研发部) UCL Centre for Artificial Intelligence(伦敦大学学院人工智能中心)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25100 2025-09-30 cs.LG cs.AI cs.CL 89%

ORPO-Distill: Mixed-Policy Preference Optimization for Cross-Architecture LLM Distillation

Aasheesh Singh, Vishal Vaddina, Dagnachew Birru

机构 * Phi Labs, Quantiphi(Phi Labs,Quantiphi)

专题命中 效率与部署 :LLM(title,abstract);preference optimization(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025, Efficient Reasoning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16980 2025-09-30 cs.CV cs.AI cs.CL cs.LG 89%

VQToken: Neural Discrete Token Representation Learning for Extreme Token Reduction in Video Large Language Models

Haichao Zhang, Yun Fu

机构 * Northeastern University(东北大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Proceedings of the 38th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17542 2025-09-30 cs.DC 89%

Disaggregated Prefill and Decoding Inference System for Large Language Model Serving on Multi-Vendor GPUs

Xing Chen, Rong Shi, Lu Zhao, Lingbin Wang, Xiao Jin, Yueqiang Chen, Hongfeng Sun

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23570 2025-09-30 cs.LG 87%

Improving constraint-based discovery with robust propagation and reliable LLM priors

Ruiqi Lyu, Alistair Turcan, Martin Jinye Zhang, Bryan Wilder

机构 * School of Computer Science(计算机科学系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14314 2025-09-30 cs.AI cs.CL cs.LG cs.MA cs.RO 87%

Towards Efficient LLM Grounding for Embodied Multi-Agent Collaboration

Yang Zhang, Shixin Yang, Chenjia Bai, Fei Wu, Xiu Li, Zhen Wang, Xuelong Li

机构 * Tsinghua University(清华大学) Northwestern Polytechnical University(西北工业大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究所) China Telecom(中国电信) Zhejiang University(浙江大学) Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments accepted by ACL'2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07672 2025-09-30 cs.CL cs.AI cs.LG 87%

OnPrem.LLM: A Privacy-Conscious Document Intelligence Toolkit

Arun S. Maiya

机构 * Institute for Defense Analyses(国防分析研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24436 2025-09-30 cs.LG cs.AI cs.NE 86%

EOE: Evolutionary Optimization of Experts for Training Language Models

Yingshi Chen

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04715 2025-09-30 cs.CL cs.CR cs.LG 86%

Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs

Will Cai, Tianneng Shi, Xuandong Zhao, Dawn Song

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23324 2025-09-30 cs.DC cs.AI 85%

Scaling LLM Test-Time Compute with Mobile NPU on Smartphones

Zixu Hao, Jianyu Wei, Tuowei Wang, Minxing Huang, Huiqiang Jiang, Shiqi Jiang, Ting Cao, Ju Ren

机构 * Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Microsoft Research(微软研究院) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07274 2025-09-30 cs.LG 85%

Cache-Efficient Posterior Sampling for Reinforcement Learning with LLM-Derived Priors Across Discrete and Continuous Domains

Ibne Farabi Shihab, Sanjeda Akter, Anuj Sharma

机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(计算机科学系,爱荷华州立大学) Department of Civil, Construction and Environmental Engineering, Iowa State University, Ames, IA, USA(土木、建设与环境工程系,爱荷华州立大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00970 2025-09-30 cs.CL cs.AI cs.LG 85%

SentenceKV: Efficient LLM Inference via Sentence-Level Semantic KV Caching

Yuxuan Zhu, Ali Falahati, David H. Yang, Mohammad Mohammadi Amiri

机构 * Department of Computer Science Rensselaer Polytechnic Institute(计算机科学系,罗切斯特理工学院) Department of Computer Science University of Waterloo(计算机科学系,滑铁卢大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22832 2025-09-30 cs.DC cs.AI cs.LG 84%

Efficient Fine-Grained GPU Performance Modeling for Distributed Deep Learning of LLM

Biyao Zhang, Mingkai Zheng, Debargha Ganguly, Xuecen Zhang, Vikash Singh, Vipin Chaudhary, Zhao Zhang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15395 2025-09-30 cs.CL cs.AI 84%

Parse Trees Guided LLM Prompt Compression

Wenhao Mao, Chengbin Hou, Tianyu Zhang, Xinyu Lin, Ke Tang, Hairong Lv

机构 * Ministry of Education Key Laboratory of Bioinformatics, BNRIST Bioinformatics Division, Department of Automation, Tsinghua University(教育部生物信息学重点实验室、BNRIST生物信息学分部、自动化系、清华大学) School of Computing and Artificial Intelligence, Fuyao University of Science and Technology(计算与人工智能学院、福耀科技大学) Department of Computer Science and Engineering, Southern University of Science and Technology(计算机科学与工程系、南方科技大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24176 2025-09-30 cs.LG 83%

FM-FoG: A Real-Time Foundation Model-based Wearable System for Freezing-of-Gait Mitigation

Chuntian Chi, John Clapham, Leslie Cloud, Ingrid Pretzer-Aboff, GinaMari Blackwell, Huajie Shao, Gang Zhou

机构 * Department of Computer Science, William \& Mary Virginia USA Department of Neurology, Virginia Commonwealth University Virginia USA School of Nursing, Virginia Commonwealth University Virginia USA Department of Computer Science, William \& Mary Department of Neurology, Virginia Commonwealth University School of Nursing, Virginia Commonwealth University

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

Comments This is a preprint version, 12 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22186 2025-09-30 cs.CV cs.CL 83%

MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing

Junbo Niu, Zheng Liu, Zhuangcheng Gu, Bin Wang, Linke Ouyang, Zhiyuan Zhao, Tao Chu, Tianyao He, Fan Wu, Qintong Zhang, Zhenjiang Jin, Guang Liang, Rui Zhang, Wenzheng Zhang, Yuan Qu, Zhifei Ren, Yuefeng Sun, Yuanhong Zheng, Dongsheng Ma, Zirui Tang, Boyu Niu, Ziyang Miao, Hejun Dong, Siyi Qian, Junyuan Zhang, Jingzhou Chen, Fangdong Wang, Xiaomeng Zhao, Liqun Wei, Wei Li, Shasha Wang, Ruiliang Xu, Yuanyuan Cao, Lu Chen, Qianqian Wu, Huaiyu Gu, Lindong Lu, Keming Wang, Dechen Lin, Guanlin Shen, Xuanhe Zhou, Linfeng Zhang, Yuhang Zang, Xiaoyi Dong, Jiaqi Wang, Bo Zhang, Lei Bai, Pei Chu, Weijia Li, Jiang Wu, Lijun Wu, Zhenxiang Li, Guangyu Wang, Zhongying Tu, Chao Xu, Kai Chen, Yu Qiao, Bowen Zhou, Dahua Lin, Wentao Zhang, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Technical Report; GitHub Repo: https://github.com/opendatalab/MinerU Hugging Face Model: https://huggingface.co/opendatalab/MinerU2.5-2509-1.2B Hugging Face Demo: https://huggingface.co/spaces/opendatalab/MinerU

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10199 2025-09-30 cs.CL 83%

Beyond Token Limits: Assessing Language Model Performance on Long Text Classification

Miklós Sebők, Viktor Kovács, Martin Bánóczy, Daniel Møller Eriksen, Nathalie Neptune, Philippe Roussille

机构 * HUN-REN Centre for Social Sciences(HUN-REN社会科学中心) Aarhus University(奥胡斯大学) Institut de Recherche en Informatique de Toulouse(图卢兹信息研究所) iL Ingénieurs(3iL工程师)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09072 2025-09-30 cs.CL 83%

READER: Retrieval-Assisted Drafter for Efficient LLM Inference

Maxim Divilkovskiy, Vitaly Malygin, Sergey Zlobin, Stanislav Ilyushin, Sultan Isali, Vasily Kalugin, Nuriza Aitassova, Fei Yi, Weidi Zeng

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00031 2025-09-30 cs.LG cs.AI 82%

End-to-End On-Device Quantization-Aware Training for LLMs at Inference Cost

Qitao Tan, Xiaoying Song, Jin Lu, Guoming Li, Jun Liu, Lingzi Hong, Caiwen Ding, Jundong Li, Xiaoming Zhai, Shaoyi Huang, Wei Niu, Geng Yuan

机构 * University of Georgia(佐治亚大学) University of North Texas(北卡罗来纳州立大学) Northeastern University(东北大学) University of Minnesota(明尼苏达大学) University of Virginia(弗吉尼亚大学) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15884 2025-09-30 cs.CL cs.AI cs.LG 82%

Jet-Nemotron: Efficient Language Model with Post Neural Architecture Search

Yuxian Gu, Qinghao Hu, Shang Yang, Haocheng Xi, Junyu Chen, Song Han, Han Cai

机构 * NVIDIA

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23625 2025-09-30 cs.CV cs.AI cs.CL cs.LG 82%

RIV: Recursive Introspection Mask Diffusion Vision Language Model

YuQian Li, Limeng Qiao, Lin Ma

机构 * Meituan(美团)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15777 2025-09-30 cs.SE 82%

Revisiting Vulnerability Patch Localization: An Empirical Study and LLM-Based Solution

Haoran Xu, Chen Zhi, Junxiao Han, Xinkui Zhao, Jianwei Yin, Shuiguang Deng

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01705 2025-09-30 cs.LG 81%

Progressive Binarization with Semi-Structured Pruning for LLMs

Xianglong Yan, Tianao Zhang, Zhiteng Li, Haotong Qin, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25072 2025-09-30 cs.CR cs.AI cs.LG 81%

Optimizing Privacy-Preserving Primitives to Support LLM-Scale Applications

Yaman Jandali, Ruisi Zhang, Nojan Sheybani, Farinaz Koushanfar

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24389 2025-09-30 cs.CL cs.AI 81%

LLaDA-MoE: A Sparse MoE Diffusion Language Model

Fengqi Zhu, Zebin You, Yipeng Xing, Zenan Huang, Lin Liu, Yihong Zhuang, Guoshan Lu, Kangyu Wang, Xudong Wang, Lanning Wei, Hongrui Guo, Jiaqi Hu, Wentao Ye, Tieyuan Chen, Chenchen Li, Chengfu Tang, Haibo Feng, Jun Hu, Jun Zhou, Xiaolu Zhang, Zhenzhong Lan, Junbo Zhao, Da Zheng, Chongxuan Li, Jianguo Li, Ji-Rong Wen

机构 * Renmin University of China(中国人民大学) Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24007 2025-09-30 cs.CL cs.LG 81%

Sequential Diffusion Language Models

Yangzhou Liu, Yue Cao, Hao Li, Gen Luo, Zhe Chen, Weiyun Wang, Xiaobo Liang, Biqing Qi, Lijun Wu, Changyao Tian, Yanting Zhang, Yuqiang Li, Tong Lu, Yu Qiao, Jifeng Dai, Wenhai Wang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) Tsinghua University(清华大学) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Soochow University(苏州大学) Donghua University(东华大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 14 pages, 5 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15110 2025-09-30 cs.LG cs.CL 81%

TDRM: Smooth Reward Models with Temporal Difference for LLM RL and Inference

Dan Zhang, Min Cai, Jonathan Light, Ziniu Hu, Yisong Yue, Jie Tang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) University of Alberta(阿尔伯塔大学) California Institute of Technology(加州理工学院) School of Electronics and Computer Science, University of Southampton(南安普顿大学电子与计算机科学学院)

专题命中 效率与部署 :LLM(title);language model(abstract);分类 cs.CL、cs.LG

Comments 10 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23146 2025-09-30 cs.CL cs.LG 81%

Tree Reward-Aligned Search for TReASURe in Masked Diffusion Language Models

Zichao Yu, Ming Li, Wenyi Zhang, Weiguo Gao

机构 * University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24014 2025-09-30 cs.CL 79%

SparseD: Sparse Attention for Diffusion Language Models

Zeqing Wang, Gongfan Fang, Xinyin Ma, Xingyi Yang, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments The code is available at https://github.com/INV-WZQ/SparseD

详情

展开后加载摘要…

URL PDF HTML 收藏