arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-17 至 2025-11-17 共收录 37 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 37 篇

2502.03460 2025-11-17 cs.LG cs.AI cs.CL 91%

Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training

Rui Pan, Shivanshu Shekhar, Boyao Wang, Shizhe Diao, Jipeng Zhang, Xingyuan Pan, Renjie Pi, Tong Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) HKUST(香港科技大学)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11017 2025-11-17 cs.LG cs.AI cs.CL cs.CV 90%

First-Order Error Matters: Accurate Compensation for Quantized Large Language Models

Xingyu Zheng, Haotong Qin, Yuye Li, Haoran Chu, Jiakai Wang, Jinyang Guo, Michele Magno, Xianglong Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by AAAI 2026. The code is available at https://github.com/Xingyu-Zheng/FOEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11018 2025-11-17 cs.CL cs.AI cs.CR cs.LG cs.SE 89%

Automata-Based Steering of Large Language Models for Diverse Structured Generation

Xiaokun Luan, Zeming Wei, Yihao Zhang, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICFEM 2025 (Best Paper Award)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10676 2025-11-17 cs.CL cs.AI 88%

Pre-Attention Expert Prediction and Prefetching for Mixture-of-Experts Large Language Models

Shien Zhu, Samuel Bohl, Robin Oester, Gustavo Alonso

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20856 2025-11-17 cs.LG cs.AI 86%

Strada-LLM: Graph LLM for traffic prediction

Seyed Mohamad Moghadas, Bruno Cornelis, Alexandre Alahi, Adrian Munteanu

机构 * Department of Electronics and Informatics, Vrije Universiteit Brussel(布鲁塞尔自由大学电子与信息系) VITA Lab, EPFL(EPFL VITA实验室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11248 2025-11-17 cs.AR 85%

T-MAN: Enabling End-to-End Low-Bit LLM Inference on NPUs via Unified Table Lookup

Jianyu Wei, Qingtao Li, Shijie Cao, Lingxiao Ma, Zixu Hao, Yanyong Zhang, Xiaoyan Hu, Ting Cao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14397 2025-11-17 cs.AR 85%

LIMINAL: Exploring The Frontiers of LLM Decode Performance

Michael Davies, Neal Crago, Karthikeyan Sankaralingam, Christos Kozyrakis

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10890 2025-11-17 cs.AI stat.ML 83%

LLM enhanced graph inference for long-term disease progression modelling

Tiantian He, An Zhao, Elinor Thompson, Anna Schroder, Ahmed Abdulaal, Frederik Barkhof, Daniel C. Alexander

机构 * Department of Computer Science(计算机科学系)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11356 2025-11-17 cs.CR 82%

SEAL: Subspace-Anchored Watermarks for LLM Ownership

Yanbo Dai, Zongjie Li, Zhenlan Ji, Shuai Wang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10692 2025-11-17 cs.SD 82%

StyleBreak: Revealing Alignment Vulnerabilities in Large Audio-Language Models via Style-Aware Audio Jailbreak

Hongyi Li, Chengxuan Zhou, Chu Wang, Sicheng Liang, Yanting Chen, Qinlin Xie, Jiawei Ye, Jie Wu

机构 * Hongyi Li, Chengxuan Zhou, Chu Wang, Sicheng Liang, Yanting Chen, Qinlin Xie, Jiawei Ye, Jie Wu(作者团队)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract)

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10652 2025-11-17 cs.CL cs.AI cs.HC cs.LG 80%

Cognitively-Inspired Episodic Memory Architectures for Accurate and Efficient Character AI

Rafael Arias Gonzalez, Steve DiPaola

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11502 2025-11-17 cs.CV cs.AI 79%

PAS : Prelim Attention Score for Detecting Object Hallucinations in Large Vision--Language Models

Nhat Hoang-Xuan, Minh Vu, My T. Thai, Manish Bhattarai

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) University of Florida(佛罗里达大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11519 2025-11-17 cs.AI cs.LG 79%

Experience-Guided Adaptation of Inference-Time Reasoning Strategies

Adam Stein, Matthew Trager, Benjamin Bowman, Michael Kleinman, Aditya Chattopadhyay, Wei Xia, Stefano Soatto

机构 * University of Pennsylvania(宾夕法尼亚大学) AWS AI(亚马逊AI)

专题命中 效率与部署 :LLM(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13812 2025-11-17 cs.HC cs.AI 78%

The Empty Chair: Using LLMs to Raise Missing Perspectives in Policy Deliberations

Suyash Fulay, Dimitra Dimitrakopoulou, Deb Roy

机构 * Center for Constructive Communication(建设性沟通中心) MIT(麻省理工学院)

专题命中 效率与部署 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.AI

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: PersonaLLM: Workshop on LLM Persona Modeling

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11510 2025-11-17 cs.CV 78%

OpenUS: A Fully Open-Source Foundation Model for Ultrasound Image Analysis via Self-Adaptive Masked Contrastive Learning

Xiaoyu Zheng, Xu Chen, Awais Rauf, Qifan Fu, Benedetta Monosi, Felice Rivellese, Myles J. Lewis, Shaogang Gong, Gregory Slabaugh

机构 * Digital Environment Research Institute (DERI), Queen Mary University of London(女王玛丽大学数字环境研究 institute(DERI)) The William Harvey Research Institute, Queen Mary University of London(女王玛丽大学威廉·哈维研究 institute) School of Electronic Engineering and Computer Science, Queen Mary University of London(女王玛丽大学电子工程与计算机科学学院)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07570 2025-11-17 cs.CV 78%

Adaptive Cache Enhancement for Test-Time Adaptation of Vision-Language Models

Khanh-Binh Nguyen, Phuoc-Nguyen Bui, Hyunseung Choo, Duc Thanh Nguyen

机构 * Deakin University(德克萨斯大学) Sungkyunkwan University(成均馆大学)

专题命中 效率与部署 :language model(title,abstract)

Comments 12 pages, Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24967 2025-11-17 cs.CR cs.AI 77%

SecInfer: Preventing Prompt Injection via Inference-time Scaling

Yupei Liu, Yanting Wang, Yuqi Jia, Jinyuan Jia, Neil Zhenqiang Gong

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10650 2025-11-17 cs.CL cs.AI cs.MA 73%

Unsupervised Cycle Detection in Agentic Applications

Felix George, Harshit Kumar, Divya Pathak, Kaustabha Ray, Mudit Verma, Pratibha Moogi

机构 * IBM Research(IBM研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11111 2025-11-17 cs.LG cs.DC 70%

SMART: A Surrogate Model for Predicting Application Runtime in Dragonfly Systems

Xin Wang, Pietro Lodi Rizzini, Sourav Medya, Zhiling Lan

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14720 2025-11-17 cs.LG cs.CV 70%

SGLP: A Similarity Guided Fast Layer Partition Pruning for Compressing Large Deep Models

Yuqi Li, Yao Lu, Junhao Dong, Zeyu Dong, Chuanguang Yang, Xin Yin, Yihao Chen, Jianping Gou, Yingli Tian, Tingwen Huang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Zhejiang University of Technology(浙江工业大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Southwest University(西南大学) The City College of New York(纽约城市学院) Shenzhen University of Advanced Technology(深圳大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15942 2025-11-17 cs.AI cs.ET cs.IT math.IT 70%

Towards Efficient and Reliable AI Through Neuromorphic Principles

Bipin Rajendran, Osvaldo Simeone, Bashir M. Al-Hashimi

机构 * Centre for Intelligent Information Processing Systems, Department of Engineering, King’s College London(智能信息处理系统中心,工程系,伦敦国王学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for publication in Philosophical Transactions A

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10810 2025-11-17 cs.AI 70%

HARNESS: Human-Agent Risk Navigation and Event Safety System for Proactive Hazard Forecasting in High-Risk DOE Environments

Ran Elgedawy, Sanjay Das, Ethan Seefried, Gavin Wiggins, Ryan Burchfield, Dana Hewit, Sudarshan Srinivasan, Todd Thomas, Prasanna Balaprakash, Tirthankar Ghosal

机构 * Oak Ridge National Laboratory(奥克勒斯国家实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11411 2025-11-17 cs.SE cs.CR 67%

SCRUTINEER: Detecting Logic-Level Usage Violations of Reusable Components in Smart Contracts

Xingshuang Lin, Binbin Zhao, Jinwen Wang, Qinge Xie, Xibin Zhao, Shouling Ji

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11106 2025-11-17 cs.MM cs.CV cs.SD 67%

AccKV: Towards Efficient Audio-Video LLMs Inference via Adaptive-Focusing and Cross-Calibration KV Cache Optimization

Zhonghua Jiang, Kui Chen, Kunxi Li, Keting Yin, Yiyun Zhou, Zhaode Wang, Chengfei Lv, Shengyu Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10568 2025-11-17 cs.LG cs.AI cs.CL cs.CV 67%

MoPE: Mixture of Prompt Experts for Parameter-Efficient and Scalable Multimodal Fusion

Ruixiang Jiang, Lingbo Liu, Changwen Chen

机构 * Department of Computing, The Hong Kong Polytechnic University(计算系,香港理工大学) Research Institute of Multiple Agents and Embodied Intelligence, Pengcheng Laboratory(多智能体与具身智能研究院,鹏城实验室)

专题命中 效率与部署 :prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to IEEE TMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20379 2025-11-17 cs.CV cs.CL cs.LG 62%

Leveraging NTPs for Efficient Hallucination Detection in VLMs

Ofir Azachi, Kfir Eliyahu, Eyal El Ani, Rom Himelstein, Roi Reichart, Yuval Pinter, Nitay Calderon

机构 * Department of Data and Decision Science, Technion - Israel Institute of Technology(数据与决策科学系,技术学院-以色列理工学院) Faculty of Computer and Information Science, Ben-Gurion University of the Negev(计算机与信息科学系,贝内-约尔根大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to The First Workshop on Confabulation, Hallucinations, & Overgeneration in Multilingual & Precision-critical Setting - AACL-IJCNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10660 2025-11-17 cs.CL cs.AI cs.IT math.IT 62%

Test-Time Steering for Lossless Text Compression via Weighted Product of Experts

Qihang Zhang, Muchen Li, Ziao Wang, Renjie Liao, Lele Wang

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) University of Michigan(密歇根大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages. Accepted by EMNLP 2025. Code and additional details are available at: https://qihang-zhang.com/Learning-Sys-Blog/2025/10/15/weighted-product-of-experts.html

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025, pages 2076-2088, Suzhou, China, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11446 2025-11-17 cs.LG 57%

DiffPro: Joint Timestep and Layer-Wise Precision Optimization for Efficient Diffusion Inference

Farhana Amin, Sabiha Afroz, Kanchon Gharami, Mona Moghadampanah, Dimitrios S. Nikolopoulos

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11418 2025-11-17 cs.LG cs.CV 57%

Low-Bit, High-Fidelity: Optimal Transport Quantization for Flow Matching

Dara Varam, Diaa A. Abuhani, Imran Zualkernan, Raghad AlDamani, Lujain Khalil

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11298 2025-11-17 cs.RO cs.AI 57%

Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation

Yihao Zhang, Yuankai Qi, Xi Zheng

机构 * Macquarie University(麦考瑞大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏