arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-14 至 2025-11-14 共收录 32 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 32 篇

2511.09873 2025-11-14 cs.CL cs.LG 90%

HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning

Nikunj Gupta, Bill Guo, Rajgopal Kannan, Viktor K. Prasanna

机构 * David S. Hippocampus Department of Computer Science Cranberry-Lemon University(Cranberry-Lemon大学计算机科学系) University of Southern California(南加州大学) DEVCOM Army Research Office(陆军研究办公室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09231 2025-11-14 cs.SE cs.AI 89%

Leveraging Large Language Models for Use Case Model Generation from Software Requirements

Tobias Eisenreich, Nicholas Friedlaender, Stefan Wagner

机构 * School of Computation, Information and Technology(计算、信息与技术学院) Technical University of Munich(慕尼黑技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted at the Intelligent Software Engineering Workshop (ISE 2025) at ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09880 2025-11-14 cs.CL cs.CR 89%

EnchTable: Unified Safety Alignment Transfer in Fine-tuned Large Language Models

Jialin Wu, Kecen Li, Zhicong Huang, Xinfeng Li, Xiaofeng Wang, Cheng Hong

机构 * Ant Group(蚂蚁集团) Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by IEEE Symposium on Security and Privacy (S&P) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18638 2025-11-14 cs.CR cs.AI cs.CL 87%

Graph of Attacks with Pruning: Optimizing Stealthy Jailbreak Prompt Generation for Enhanced LLM Content Moderation

Daniel Schwartz, Dmitriy Bespalov, Zhe Wang, Ninad Kulkarni, Yanjun Qi

机构 * Amazon Bedrock Science(亚马逊Bedrock科学) Drexel University(德雷塞尔大学) University of Virginia(弗吉尼亚大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures; published in EMNLP 2025 ; Code at: https://github.com/dsbuddy/GAP-LLM-Safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09820 2025-11-14 cs.CV cs.AI 85%

From Street to Orbit: Training-Free Cross-View Retrieval via Location Semantics and LLM Guidance

Jeongho Min, Dongyoung Kim, Jaehyup Lee

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to WACV 2026, 10pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09883 2025-11-14 cs.CV 85%

HCC-3D: Hierarchical Compensatory Compression for 98% 3D Token Reduction in Vision-Language Models

Liheng Zhang, Jin Wang, Hui Li, Bingfeng Zhang, Weifeng Liu

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14617 2025-11-14 cs.DC 85%

SageServe: Optimizing LLM Serving on Cloud Data Centers with Forecast Aware Auto-Scaling

Shashwat Jaiswal, Kunal Jain, Yogesh Simmhan, Anjaly Parayil, Ankur Mallick, Rujia Wang, Renee St. Amant, Chetan Bansal, Victor Rühle, Anoop Kulkarni, Steve Kofsky, Saravan Rajmohan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 25 pages, 16 figures, 2 tables. The workload traces, our simulator harness and the SageServe scheduler are available at https://github.com/shashwatj07/SageServe

Journal ref Proceedings of the ACM on Measurement and Analysis of Computing Systems, Vol. 9, No. 3, Article 61. December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10232 2025-11-14 cs.CL cs.AI cs.SD 84%

VocalNet-M2: Advancing Low-Latency Spoken Language Modeling via Integrated Multi-Codebook Tokenization and Multi-Token Prediction

Yuhao Wang, Ziyang Cheng, Heyang Liu, Ronghua Wu, Qunshan Gu, Yanfeng Wang, Yu Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

专题命中 效率与部署 :language model(title,abstract);SLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09748 2025-11-14 cs.CL cs.AI 84%

How Small Can You Go? Compact Language Models for On-Device Critical Error Detection in Machine Translation

Muskaan Chopra, Lorenz Sparrenberg, Sarthak Khanna, Rafet Sifa

机构 * Fraunhofer IAIS - Department of Media Engineering(弗劳恩霍夫人工智能研究所-媒体工程部门) University of Bonn - Department of Computer Science(波恩大学-计算机科学系) Lamarr Institute for Machine Learning(拉马尔人工智能与机器学习研究所)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in IEEE BigData 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08903 2025-11-14 cs.CV 82%

LLM-Guided Probabilistic Fusion for Label-Efficient Document Layout Analysis

Ibne Farabi Shihab, Sanjeda Akter, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建设与环境工程系,爱荷华州立大学)

专题命中 效率与部署 :LLM(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10281 2025-11-14 cs.AI cs.CL 79%

FactGuard: Event-Centric and Commonsense-Guided Fake News Detection

Jing He, Han Zhang, Yuanhui Xiao, Wei Guo, Shaowen Yao, Renyang Liu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10087 2025-11-14 cs.RO cs.AI cs.LG 79%

Opinion: Towards Unified Expressive Policy Optimization for Robust Robot Learning

Haidong Huang, Haiyue Zhu. Jiayu Song, Xixin Zhao, Yaohua Zhou, Jiayi Zhang, Yuze Zhai, Xiaocong Li

机构 * Eastern Institute of Technology(东部技术研究所) University of Nottingham(诺丁汉大学) SIMTech, Agency for Science, Technology and Research (A*STAR)(SIMTech,科技研究局(A*STAR)) Southern University of Science and Technology(南方科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025 Workshop on Embodied World Models for Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17741 2025-11-14 cs.DC cs.AR cs.OS cs.PF 78%

Chameleon: Adaptive Caching and Scheduling for Many-Adapter LLM Inference Environments

Nikoleta Iliakopoulou, Jovan Stojkovic, Chloe Alverti, Tianyin Xu, Hubertus Franke, Josep Torrellas

专题命中 效率与部署 :LLM(title,abstract)

Comments Accepted at MICRO '25

Journal ref MICRO 58, 2025, 15

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06347 2025-11-14 quant-ph cs.AI hep-lat hep-ph 77%

Scalable Quantum State Preparation via Large-Language-Model-Driven Discovery

Qing-Hong Cao, Zong-Yue Hou, Ying-Ying Li, Xiaohui Liu, Zhuo-Yang Song, Liang-Qi Zhang, Shutao Zhang, Ke Zhao

机构 * School of Physics, Peking University(北京大学物理学院) Center for High Energy Physics, Peking University(北京大学高能物理中心) Institute of High Energy Physics, Chinese Academy of Sciences(中国科学院高能物理研究所) Center of Advanced Quantum Studies, School of Physics and Astronomy, Beijing Normal University(北京师范大学物理天文学院先进量子研究中心) Key Laboratory of Multi-scale Spin Physics, Ministry of Education, Beijing Normal University(北京师范大学教育部多尺度自旋物理重点实验室)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 + 3 pages, 9 figures. Substantially update the draft, including a study of the 2+1d scalar field theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15045 2025-11-14 cs.CL 77%

Error Correction in Radiology Reports: A Knowledge Distillation-Based Multi-Stage Framework

Jinge Wu, Zhaolong Wu, Ruizhe Li, Tong Chen, Abul Hasan, Yunsoo Kim, Jason P. Y. Cheung, Teng Zhang, Honghan Wu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10618 2025-11-14 cs.CL cs.AI cs.IT cs.LG math.IT 75%

Know Your Limits: Entropy Estimation Modeling for Compression and Generalization

Benjamin L. Badger, Matthew Neligeorge

机构 * IBM(国际商业机器公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10395 2025-11-14 cs.LG cs.AI cs.CL 75%

AgentEvolver: Towards Efficient Self-Evolving Agent System

Yunpeng Zhai, Shuchang Tao, Cheng Chen, Anni Zou, Ziqian Chen, Qingxu Fu, Shinji Mai, Li Yu, Jiaji Deng, Zouying Cao, Zhaoyang Liu, Bolin Ding, Jingren Zhou

机构 * Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11954 2025-11-14 cs.NE cs.AI 74%

Spikingformer: A Key Foundation Model for Spiking Neural Networks

Chenlin Zhou, Liutao Yu, Zhaokun Zhou, Han Zhang, Jiaqi Wang, Huihui Zhou, Zhengyu Ma, Yonghong Tian

专题命中 效率与部署 :foundation model(title);分类 cs.AI

Comments Accepted by AAAI 2026 (Oral), Code: https://github.com/TheBrainLab/Spikingformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10215 2025-11-14 cs.CL cs.AI 73%

Persona-Aware Alignment Framework for Personalized Dialogue Generation

Guanrong Li, Xinyu Liu, Zhen Wu, Xinyu Dai

机构 * National Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) Nanjing University(南京大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Pre-MIT Press publication version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10552 2025-11-14 cs.CL 70%

URaG: Unified Retrieval and Generation in Multimodal LLMs for Efficient Long Document Understanding

Yongxin Shi, Jiapeng Wang, Zeyu Shan, Dezhi Peng, Zening Lin, Lianwen Jin

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10014 2025-11-14 q-bio.QM cs.AI 70%

fastbmRAG: A Fast Graph-Based RAG Framework for Efficient Processing of Large-Scale Biomedical Literature

Guofeng Meng, Li Shen, Qiuyan Zhong, Wei Wang, Haizhou Zhang, Xiaozhen Wang

机构 * Changchun GeneScience Pharmaceuticals Co., Ltd.(长春基因科学制药有限公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 2 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02909 2025-11-14 cs.LG 70%

Fine-grained Token Allocation Via Operation Pruning for Efficient MLLMs

Aoming Liu, Reuben Tan, Boqing Gong, Bryan A. Plummer

机构 * Boston University(波士顿大学) Microsoft Research(微软研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20194 2025-11-14 cs.LG 70%

DuoGPT: Training-free Dual Sparsity through Activation-aware Pruning in LLMs

Ruokai Yin, Yuhang Li, Donghyun Lee, Priyadarshini Panda

机构 * Yale University(耶鲁大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS 2025. The code is available on Github (see hyperlink in the paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10081 2025-11-14 cs.CV 67%

GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs

Yuxiang Duan, Ao Li, Yingqin Li, Luyu Li, Pengwei Wang

机构 * Shandong University(山东大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10074 2025-11-14 cs.CV cs.SY eess.SY 67%

VLF-MSC: Vision-Language Feature-Based Multimodal Semantic Communication System

Gwangyeon Ahn, Jiwan Seo, Joonhyuk Kang

专题命中 效率与部署 :language model(abstract);foundation model(abstract)

Comments To appear in the AI4NextG Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09955 2025-11-14 cs.CV 67%

Robust Object Detection with Pseudo Labels from VLMs using Per-Object Co-teaching

Uday Bhaskar, Rishabh Bhattacharya, Avinash Patel, Sarthak Khoche, Praveen Anil Kulkarni, Naresh Manwani

机构 * Machine Learning Lab IIIT Hyderabad(IIIT Hyderabad 机器学习实验室) Bosch Global Software Technologies(博世全球软件技术公司)

专题命中 效率与部署 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05469 2025-11-14 cs.CV 67%

Generating Physically Stable and Buildable Brick Structures from Text

Ava Pun, Kangle Deng, Ruixuan Liu, Deva Ramanan, Changliu Liu, Jun-Yan Zhu

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Project page: https://avalovelace1.github.io/BrickGPT/

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), 2025, pp. 14798-14809

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10054 2025-11-14 cs.LG cs.AI 62%

BuddyMoE: Exploiting Expert Redundancy to Accelerate Memory-Constrained Mixture-of-Experts Inference

Yun Wang, Lingyun Yang, Senhao Yu, Yixiao Wang, Ruixing Li, Zhixiang Wei, James Yen, Zhengwei Qi

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18927 2025-11-14 cs.LG 57%

From Tiny Machine Learning to Tiny Deep Learning: A Survey

Shriyank Somvanshi, Md Monzurul Islam, Gaurab Chhetri, Rohit Chakraborty, Mahmuda Sultana Mimi, Sawgat Ahmed Shuvo, Kazi Sifatul Islam, Syed Aaqib Javed, Sharif Ahmed Rafat, Anandi Dutta, Subasish Das

机构 * Texas State University(德克萨斯州立大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

Journal ref ACM CS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09844 2025-11-14 cs.LG cs.PF 57%

Steering Pretrained Drafters during Speculative Decoding

Frédéric Berdoz, Peer Rheinboldt, Roger Wattenhofer

专题命中 效率与部署 :language model(abstract);分类 cs.LG

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏