arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-14 至 2025-10-14 共收录 399 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 63 篇

2506.01249 2025-10-14 cs.SE cs.PF 86%

SysLLMatic: Large Language Models are Software System Optimizers

Huiyun Peng, Arjun Gupte, Ryan Hasler, Nicholas John Eliopoulos, Chien-Chou Ho, Rishi Mantri, Leo Deng, Konstantin Läufer, George K. Thiruvathukal, James C. Davis

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10849 2025-10-14 cs.LG 85%

Glance for Context: Learning When to Leverage LLMs for Node-Aware GNN-LLM Fusion

Donald Loveland, Yao-An Yang, Danai Koutra

机构 * Department of Computer Science and Engineering University of Michigan(计算机科学与工程系 密歇根大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23841 2025-10-14 cs.IR cs.CL 85%

SkewRoute: Training-Free LLM Routing for Knowledge Graph Retrieval-Augmented Generation via Score Skewness of Retrieved Context

Hairu Wang, Yuan Feng, Yukun Cao, Xike Xie, S Kevin Zhou

机构 * School of Computer Science, University of Science and Technology of China(中国科学技术大学计算机科学学院) School of Biomedical Engineering, USTC(USTC生物医学工程学院) Suzhou Institute for Advanced Reasearch, USTC(USTC苏州市先进研究所)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09942 2025-10-14 cs.LG cs.AI cs.IT math.IT 85%

Conformal Sparsification for Bandwidth-Efficient Edge-Cloud Speculative Decoding

Payel Bhattacharjee, Fengwei Tian, Meiyu Zhong, Guangyi Zhang, Osvaldo Simeone, Ravi Tandon

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系;亚利桑那大学;美国亚利桑那州图森) University of Arizona(信息科学与电子工程学院;浙江大学;中国杭州310027) Tucson, AZ, USA(工程系;伦敦国王学院;英国伦敦) College of Information Science and Electronic Engineering, Zhejiang University, Hangzhou 310027, China Department of Engineering King’s College London London, UK

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI and ML for Next-Generation Wireless Communications and Networking (AI4NextG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09722 2025-10-14 cs.CL cs.AI cs.CV 85%

Layout-Aware Parsing Meets Efficient LLMs: A Unified, Scalable Framework for Resume Information Extraction and Evaluation

Fanwei Zhu, Jinke Yu, Zulong Chen, Ying Zhou, Junhao Ji, Zhibo Yang, Yuxue Zhang, Haoyuan Hu, Zhenghao Liu

机构 * Hangzhou City University(杭州市大学) Alibaba Group(阿里巴巴集团) Zhejiang Lab(浙江实验室) Alibaba Cloud(阿里云) Northeastern University(东北大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11331 2025-10-14 eess.SY cs.SY 85%

Efficient LLM Inference over Heterogeneous Edge Networks with Speculative Decoding

Bingjie Zhu, Zhixiong Chen, Liqiang Zhao, Hyundong Shin, Arumugam Nallanathan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18846 2025-10-14 cs.CR 85%

LLM-Driven APT Detection for 6G Wireless Networks: A Systematic Review and Taxonomy

Muhammed Golec, Yaser Khamayseh, Suhib Bani Melhem, Abdulmalik Alwarafy

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 22 pages, 11 figures, 8 tables. Submitted to Computer Science Review (Elsevier), May 2025

Journal ref IEEE Access 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09981 2025-10-14 cs.CV eess.IV 85%

Scaling Traffic Insights with AI and Language Model-Powered Camera Systems for Data-Driven Transportation Decision Making

Fan Zuo, Donglin Zhou, Jingqin Gao, Kaan Ozbay

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11615 2025-10-14 cs.CL cs.AI 84%

LLM-Oriented Token-Adaptive Knowledge Distillation

Xurong Xie, Zhucun Xue, Jiafu Wu, Jian Li, Yabiao Wang, Xiaobin Hu, Yong Liu, Jiangning Zhang

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10138 2025-10-14 cs.CL cs.AI 84%

Hybrid OCR-LLM Framework for Enterprise-Scale Document Information Extraction Under Copy-heavy Task

Zilong Wang, Xiaoyu Shen

机构 * Ningbo Institute of Digital Twin(宁波数字孪生研究所) Eastern Institute of Technology(东部技术研究所)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10885 2025-10-14 cs.CL cs.DB 81%

Rethinking Agentic Workflows: Evaluating Inference-Based Test-Time Scaling Strategies in Text2SQL Tasks

Jiajing Guo, Kenil Patel, Jorge Piazentin Ono, Wenbin He, Liu Ren

机构 * Bosch Research North America, USA(博世美国研究北美洲) Bosch Center for Artificial Intelligence (BCAI)(博世人工智能中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at COLM 2025 SCALR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14019 2025-10-14 cs.AI cs.AR cs.PL 80%

ChipGPT: How far are we from natural language hardware design

Kaiyan Chang, Ying Wang, Haimeng Ren, Mengdi Wang, Shengwen Liang, Yinhe Han, Huawei Li, Xiaowei Li

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences, China(处理器国家重点实验室,计算技术研究所,中国科学院,中国) University of Chinese Academy of Sciences(中国科学院大学) School of Information Science and Technology, ShanghaiTech University, China(信息科学与技术学院,上海科技大学,中国)

专题命中 效率与部署 :LLM(abstract,comments);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI

Comments Accepted by 2023 NeurIPS SysML Workshop, retitled to "Improving Large Language Model Hardware Generating Quality through Post-LLM Search"

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01092 2025-10-14 cs.CL cs.AI cs.LG 80%

REFRAG: Rethinking RAG based Decoding

Xiaoqiang Lin, Aritra Ghosh, Bryan Kian Hsiang Low, Anshumali Shrivastava, Vijai Mohan

机构 * Meta Superintelligence Labs(Meta超智能实验室) National University of Singapore(新加坡国立大学) Rice University(Rice大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments fix typo perplexity->log perplexity; added recent papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16743 2025-10-14 cs.CL cs.AI cs.LG 80%

TRIM: Achieving Extreme Sparsity with Targeted Row-wise Iterative Metric-driven Pruning

Florentin Beck, William Rudman, Carsten Eickhoff

机构 * University of Tübingen, School of Medicine(图宾根大学医学院) University of Texas at Austin, Department of Linguistics(德克萨斯大学奥斯汀分校语言学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10663 2025-10-14 cs.CV cs.AI 79%

Scalable Face Security Vision Foundation Model for Deepfake, Diffusion, and Spoofing Detection

Gaojian Wang, Feng Lin, Tong Wu, Zhisheng Yan, Kui Ren

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

Comments 18 pages, 9 figures, project page: https://fsfm-3c.github.io/fsvfm.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10010 2025-10-14 cs.SE cs.AI 79%

SLEAN: Simple Lightweight Ensemble Analysis Network for Multi-Provider LLM Coordination: Design, Implementation, and Vibe Coding Bug Investigation Case Study

Matheus J. T. Vargas

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

Comments 14 pages, 4 figures, 6 tables, link to code repo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09849 2025-10-14 cs.CL cs.CV 79%

Text Prompt Injection of Vision Language Models

Ruizhe Zhu

机构 * Ruizhe Zhu(独立研究者)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11696 2025-10-14 cs.LG cs.CL cs.CV 79%

QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMs

Wei Huang, Yi Ge, Shuai Yang, Yicheng Xiao, Huizi Mao, Yujun Lin, Hanrong Ye, Sifei Liu, Ka Chun Cheung, Hongxu Yin, Yao Lu, Xiaojuan Qi, Song Han, Yukang Chen

机构 * NVIDIA MIT(麻省理工学院) HKU(香港大学) THU(清华大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Code is available at https://github.com/NVlabs/QeRL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13380 2025-10-14 cs.RO cs.AI cs.LG cs.MA cs.SY eess.SY 79%

ASTREA: Introducing Agentic Intelligence for Orbital Thermal Autonomy

Alejandro D. Mousist

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for presentation at the European Space Agency's AI Start 2025 Conference (see https://atpi.eventsair.com/ai-star-2025/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06427 2025-10-14 cs.CV 78%

When Language Model Guides Vision: Grounding DINO for Cattle Muzzle Detection

Rabin Dulal, Lihong Zheng, Muhammad Ashad Kabir

机构 * School of Computing, Mathematics and Engineering(计算数学与工程学院) Charles Sturt University(查尔斯·斯特劳特大学) Gulbali Institute for Agriculture, Water and Environment(古尔巴利农业、水与环境研究所) Food Agility CRC Ltd(食品敏捷性CRC有限公司)

专题命中 效率与部署 :language model(title,abstract)

Journal ref Australasian Joint Conference on Artificial Intelligence 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10287 2025-10-14 cs.CV cs.RO 78%

Bridging Perspectives: Foundation Model Guided BEV Maps for 3D Object Detection and Tracking

Markus Käppeler, Özgün Çiçek, Daniele Cattaneo, Claudius Gläser, Yakov Miron, Abhinav Valada

机构 * Department of Computer Science, University of Freiburg, Germany(弗赖堡大学计算机科学系) Bosch Research, Robert Bosch GmbH, Renningen, Germany(博世研究)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04991 2025-10-14 cs.RO 78%

Efficient Navigation in Unknown Indoor Environments with Vision-Language Models

D. Schwartz, K. Kondo, J. P. How

机构 * ETH Zürich(苏黎世联邦理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 效率与部署 :language model(title,abstract)

Comments 7 pages, 4 figures, accepted to the OWN workshop at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11192 2025-10-14 cs.AR cs.LG 77%

Efficient In-Memory Acceleration of Sparse Block Diagonal LLMs

João Paulo Cardoso de Lima, Marc Dietrich, Jeronimo Castrillon, Asif Ali Khan

机构 * Chair for Compiler Construction, TU Dresden, Germany(编译构造研究所,德累斯顿技术大学,德国) Center for Scalable Data Analytics and Artificial Intelligence (ScaDS.AI), Dresden, Germany(可扩展数据分析与人工智能中心(ScaDS.AI),德累斯顿,德国)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 8 pages, to appear in IEEE Cross-disciplinary Conference on Memory-Centric Computing (CCMCC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11119 2025-10-14 cs.AI cs.AR cs.DC 77%

Improving AI Efficiency in Data Centres by Power Dynamic Response

Andrea Marinoni, Sai Shivareddy, Pietro Lio', Weisi Lin, Erik Cambria, Clare Grey

机构 * Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学) Nyobolt Limited(Nyobolt有限公司) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Yusuf Hamied Department of Chemistry(尤素夫·哈米德化学系)

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10713 2025-10-14 astro-ph.IM astro-ph.CO astro-ph.EP astro-ph.GA astro-ph.HE cs.AI 77%

Deep Learning in Astrophysics

Yuan-Sen Ting

机构 * Yuan-Sen Ting 1,2,3

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

Comments Manuscript submitted to Annual Review of Astronomy and Astrophysics for Volume 64. This is the authors' version. Revisions and the final version will be available at https://www.annualreviews.org/content/journals/astro

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16227 2025-10-14 cs.CL cs.AI cs.LG 75%

Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning

Bohao Wu, Qingyun Wang, Yue Guo

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) William & Mary(威廉与玛丽学院)

专题命中 效率与部署 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12067 2025-10-14 cs.CV 75%

A Comprehensive Survey on Knowledge Distillation

Amir M. Mansourian, Rozhan Ahmadi, Masoud Ghafouri, Amir Mohammad Babaei, Elaheh Badali Golezani, Zeynab Yasamani Ghamchi, Vida Ramezanian, Alireza Taherian, Kimia Dinashi, Amirali Miri, Shohreh Kasaei

机构 * Sharif University of Technology(谢里夫科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments Published at TMLR (102 pages, 10 figures, 17 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13563 2025-10-14 cs.LG cs.AI cs.CV 73%

Breaking the Compression Ceiling: Data-Free Pipeline for Ultra-Efficient Delta Compression

Xiaohui Wang, Peng Ye, Chenyu Huang, Shenghe Zheng, Bo Zhang, Lei Bai, Wanli Ouyang, Tao Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10962 2025-10-14 cs.LG cs.AI 73%

MC#: Mixture Compressor for Mixture-of-Experts Large Models

Wei Huang, Yue Liao, Yukang Chen, Jianhui Liu, Haoru Tan, Si Liu, Shiming Zhang, Shuicheng Yan, Xiaojuan Qi

机构 * Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) School of Computing, National University of Singapore(新加坡国立大学计算机学院) NVIDIA Research(NVIDIA研究)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17368 2025-10-14 cs.LG cs.AI cs.CR 73%

SAFEx: Analyzing Vulnerabilities of MoE-Based LLMs via Stable Safety-critical Expert Identification

Zhenglin Lai, Mengyao Liao, Bingzhe Wu, Dong Xu, Zebin Zhao, Zhihang Yuan, Chao Fan, Jianqiang Li

机构 * School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院) ByteDance Inc(字节跳动公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏