arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-18 至 2025-11-18 共收录 428 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 88 篇

2511.11621 2025-11-18 cs.DC cs.AI cs.NI 85%

AIvailable: A Software-Defined Architecture for LLM-as-a-Service on Heterogeneous and Legacy GPUs

Pedro Antunes, Ana Rita Ortigoso, Gabriel Vieira, Daniel Fuentes, Luís Frazão, Nuno Costa, António Pereira

机构 * Computer Science and Communication Research Centre(计算机科学与通信研究中心) Polytechnic University of Leiria(利尔亚理工学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11574 2025-11-18 cs.LG 85%

LLM on a Budget: Active Knowledge Distillation for Efficient Classification of Large Text Corpora

Viviana Luccioli, Rithika Iyengar, Ryan Panley, Flora Haberkorn, Xiaoyu Ge, Leland Crane, Nitish Sinha, Seung Jung Lee

机构 * Board of Governors of the Federal Reserve System(联邦储备系统委员会)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11617 2025-11-18 cs.DC 85%

AnchorTP: Resilient LLM Inference with State-Preserving Elastic Tensor Parallelism

Wendong Xu, Chujie Chen, He Xiao, Kuan Li, Jing Xiong, Chen Zhang, Wenyong Zhou, Chaofan Tao, Yang Bai, Bei Yu, Ngai Wong

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments accpeted paper by Design, Automation and Test in Europe Conference (DATE'26). 8 pages in total with 6 figures and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11225 2025-11-18 cs.CL cs.AI cs.LG 85%

HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization

Chengyu Huang, Zhengxin Zhang, Claire Cardie

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11678 2025-11-18 cs.DC cs.AI cs.CL cs.LG 83%

A Structure-Agnostic Co-Tuning Framework for LLMs and SLMs in Cloud-Edge Systems

Yuze Liu, Yunhan Wang, Tiehua Zhang, Zhishu Shen, Cheng Peng, Libing Wu, Feng Xia, Jiong Jin

机构 * Swinburne University of Technology(斯威本理工大学) Tongji University(同济大学) Wuhan University of Technology(武汉理工大学) INFLY TECH (Shanghai) Co., Ltd.(INFLY TECH(上海)有限公司) Wuhan University(武汉大学) RMIT University(皇家墨尔本理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12286 2025-11-18 cs.AR cs.AI 83%

Sangam: Chiplet-Based DRAM-PIM Accelerator with CXL Integration for LLM Inferencing

Khyati Kiyawat, Zhenxing Fan, Yasas Seneviratne, Morteza Baradaran, Akhil Shekar, Zihan Xia, Mingu Kang, Kevin Skadron

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11000 2025-11-18 cs.SD cs.AI 83%

DialogGraph-LLM: Graph-Informed LLMs for End-to-End Audio Dialogue Intent Recognition

HongYu Liu, Junxin Li, Changxi Guo, Hao Chen, Yaqian Huang, Yifu Guo, Huan Yang, Lihua Cai

机构 * South China Normal University, Guangzhou, China(华南师范大学) Xiamen Rekey Medical Technology Co., LTD, Xiamen, China(厦门瑞康医疗科技有限公司)

专题命中 效率与部署 :LLM(title,abstract);foundation model(abstract);分类 cs.AI

Comments 8 pages, 2 figures. To appear in: Proceedings of the 28th European Conference on Artificial Intelligence (ECAI 2025), Frontiers in Artificial Intelligence and Applications, Vol. 413. DOI: 10.3233/FAIA251182

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09883 2025-11-18 cs.CV cs.AI 83%

3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation

Seonho Lee, Jiho Choi, Inha Kang, Jiwook Kim, Junsung Park, Hyunjung Shim

专题命中 效率与部署 :language model(title,abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11971 2025-11-18 physics.optics 82%

Channel Ordering for Fairness in Elastic Optical Networks via a LLM-Guided Bottleneck TSP Solver

Liangshun Wu, Wen Chen, Qingqing Wu

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12991 2025-11-18 cs.CL 81%

Fine-Tuned LLMs Know They Don't Know: A Parameter-Efficient Approach to Recovering Honesty

Zeyu Shi, Ziming Wang, Tianyu Chen, Shiqi Gao, Haoyi Zhou, Qingyun Sun, Jianxin Li

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted by AAAI 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12614 2025-11-18 cs.CV cs.AI cs.LG cs.RO 81%

OPFormer: Object Pose Estimation leveraging foundation model with geometric encoding

Artem Moroz, Vít Zeman, Martin Mikšík, Elizaveta Isianova, Miroslav David, Pavel Burget, Varun Burde

机构 * Czech Institute of Informatics, Robotics and Cybernetics(捷克信息学、机器人学与自动化研究所) Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02503 2025-11-18 cs.AI cs.CL 81%

OptiHive: Ensemble Selection for LLM-Based Optimization via Statistical Modeling

Maxime Bouscary, Saurabh Amin

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13676 2025-11-18 cs.AR cs.LG 79%

T-SAR: A Full-Stack Co-design for CPU-Only Ternary LLM Inference via In-Place SIMD ALU Reorganization

Hyunwoo Oh, KyungIn Nam, Rajat Bhattacharjya, Hanning Chen, Tamoghno Das, Sanggeon Yun, Suyeon Jang, Andrew Ding, Nikil Dutt, Mohsen Imani

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

Comments Accepted to DATE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13458 2025-11-18 cs.HC cs.AI cs.CV 79%

Trust in Vision-Language Models: Insights from a Participatory User Workshop

Agnese Chiatti, Lara Piccolo, Sara Bernardini, Matteo Matteucci, Viola Schiaffonati

机构 * University of Oxford, UK(牛津大学) CODE University of Applied Sciences, Germany(应用科学学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Journal ref Proceedings of the The European Workshop on Trustworthy AI (Trust-AI) at ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20630 2025-11-18 cs.CV cs.AI 79%

TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model

Ao Li, Yuxiang Duan, Jinghui Zhang, Congbo Ma, Yutong Xie, Gustavo Carneiro, Mohammad Yaqub, Hu Wang

机构 * Shandong University(山东大学) MBZUAI New York University Abu Dhabi(纽约大学阿布扎赫分校) University of Surrey(塞雷尔大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23320 2025-11-18 eess.AS cs.AI cs.SD 79%

Lina-Speech: Gated Linear Attention and Initial-State Tuning for Multi-Sample Prompting Text-To-Speech Synthesis

Théodor Lemerle, Téo Guichoux, Axel Roebel, Nicolas Obin

专题命中 效率与部署 :prompting(title);language model(abstract);分类 cs.AI

Comments Audio-AAAI Workshop, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13061 2025-11-18 cs.LG cs.AI cs.DC cs.DS 79%

MACKO: Sparse Matrix-Vector Multiplication for Low Sparsity

Vladimír Macko, Vladimír Boža

机构 * Faculty of Mathematics, Physics and Informatics Comenius University Bratislava(数学物理信息学系 哥梅尼乌斯大学布拉迪斯拉瓦)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages + 7 pages appendix, 11 figures, Code available at https://github.com/vlejd/macko_spmv

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07998 2025-11-18 cs.CL cs.AI 79%

Self-Correction Distillation for Structured Data Question Answering

Yushan Zhu, Wen Zhang, Long Jin, Mengshu Sun, Ling Zhong, Zhiqiang Liu, Juan Li, Lei Liang, Chong Long, Chao Deng, Junlan Feng

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14902 2025-11-18 cs.CL cs.AI cs.IR 79%

PathRAG: Pruning Graph-based Retrieval Augmented Generation with Relational Paths

Boyu Chen, Zirui Guo, Zidan Yang, Yuluo Chen, Junze Chen, Zhenghao Liu, Chuan Shi, Cheng Yang

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09981 2025-11-18 cs.CV 78%

LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit

Chengtao Lv, Bilang Zhang, Yang Yong, Ruihao Gong, Yushi Huang, Shiqiao Gu, Jiajun Wu, Yumeng Shi, Jinyang Guo, Wenya Wang

专题命中 效率与部署 :language model(title,abstract)

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12428 2025-11-18 cs.CV 78%

RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning

Jingqi Xu, Jingxi Lu, Chenghao Li, Sreetama Sarkar, Souvik Kundu, Peter A. Beerel

机构 * University of Southern California(南加州大学) Intel Labs(英特尔实验室)

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12660 2025-11-18 cs.CV 78%

On the Use of Hierarchical Vision Foundation Models for Low-Cost Human Mesh Recovery and Pose Estimation

Shuhei Tarashima, Yushan Wang, Norio Tagawa

机构 * NTT DOCOMO Business(NTT DOCOMO公司) Tokyo Metropolitan University(东京 Metropolitan大学)

专题命中 效率与部署 :foundation model(title,abstract)

Comments Accepted at ICCVW 2025. Code: https://github.com/nttcom/TruncHierVFM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12979 2025-11-18 cs.LG cs.DB 77%

RAGPulse: An Open-Source RAG Workload Trace to Optimize RAG Serving Systems

Zhengchao Wang, Yitao Hu, Jianing Ye, Zhuxuan Chang, Jiazheng Yu, Youpeng Deng, Keqiu Li

机构 * Tianjin University, China(天津大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12913 2025-11-18 cs.AI 77%

CoS: Towards Optimal Event Scheduling via Chain-of-Scheduling

Yiming Zhao, Jiwei Tang, Shimin Di, Libin Zheng, Jianxing Yu, Jian Yin

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07202 2025-11-18 cs.HC cs.CL 77%

Neurocognitive Modeling for Text Generation: Deep Learning Architecture for EEG Data

Khushiyant

机构 * Department of Computer Science University of Freiburg(计算机科学系弗赖堡大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06105 2025-11-18 cs.CL 77%

You Don't Need Pre-built Graphs for RAG: Retrieval Augmented Generation with Adaptive Reasoning Structures

Shengyuan Chen, Chuang Zhou, Zheng Yuan, Qinggang Zhang, Zeyang Cui, Hao Chen, Yilin Xiao, Jiannong Cao, Xiao Huang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments This work has been accepted to AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04990 2025-11-18 cs.CL 77%

DP-GTR: Differentially Private Prompt Protection via Group Text Rewriting

Mingchen Li, Heng Fan, Song Fu, Junhua Ding, Yunhe Feng

机构 * University of North Texas(北卡罗来纳州立大学) Department of Computer Science and Engineering(计算机科学与工程系) Department of Data Science(数据科学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 9 pages, 3 figures, 5 tables

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11885 2025-11-18 cs.DC cs.AI cs.DB 77%

Flash-Fusion: Enabling Expressive, Low-Latency Queries on IoT Sensor Streams with LLMs

Kausar Patherya, Ashutosh Dhekne, Francisco Romero

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 12 pages, 5 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12860 2025-11-18 cs.AR 75%

Dissecting and Re-architecting 3D NAND Flash PIM Arrays for Efficient Single-Batch Token Generation in LLMs

Yongjoo Jang, Sangwoo Hwang, Hojin Lee, Sangwoo Jung, Donghun Lee, Wonbo Shim, Jaeha Kung

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Comments This paper is accepted in the 43rd IEEE International Conference on Computer Design (ICCD), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12368 2025-11-18 cs.CV 75%

Fast Reasoning Segmentation for Images and Videos

Yiqing Shen, Mathias Unberath

机构 * Department of Computer Science, Johns Hopkins University(计算机科学系,约翰·霍普金斯大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏