arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22405 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22405 篇

2502.09766 2025-03-05 cs.SE 85%

LLM-Generated Microservice Implementations from RESTful API Definitions

Saurabh Chauhan, Zeeshan Rasheed, Abdul Malik Sami, Zheying Zhang, Jussi Rasku, Kai-Kristian Kemell, Pekka Abrahamsson

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01319 2025-03-04 cs.SE 85%

ABFS: Natural Robustness Testing for LLM-based NLP Software

Mingxuan Xiao, Yan Xiao, Shunhui Ji, Yunhe Li, Lei Xue, Pengcheng Zhang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00813 2025-03-04 cs.DC 85%

HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning

Qianli Liu, Zhaorui Zhang, Xin Yao, Benben Liu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00502 2025-03-04 cs.RO 85%

Interact, Instruct to Improve: A LLM-Driven Parallel Actor-Reasoner Framework for Enhancing Autonomous Vehicle Interactions

Shiyu Fang, Jiaqi Liu, Chengkai Xu, Chen Lv, Peng Hang, Jian Sun

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16963 2025-02-25 cs.AR 85%

Make LLM Inference Affordable to Everyone: Augmenting GPU Memory with NDP-DIMM

Lian Liu, Shixin Zhao, Bing Li, Haimeng Ren, Zhaohui Xu, Mengdi Wang, Xiaowei Li, Yinhe Han, Ying Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages, 17 figures, accepted by HPCA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16924 2025-02-25 cs.IR 85%

FilterLLM: Text-To-Distribution LLM for Billion-Scale Cold-Start Recommendation

Ruochen Liu, Hao Chen, Yuanchen Bei, Zheyu Zhou, Lijia Chen, Qijie Shen, Feiran Huang, Fakhri Karray, Senzhang Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16199 2025-02-25 cs.NI 85%

LLMKey: LLM-Powered Wireless Key Generation Scheme for Next-Gen IoV Systems

Huanqi Yang, Weitao Xu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15304 2025-02-24 cs.LG cs.AI cs.CL 85%

SVDq: 1.25-bit and 410x Key Cache Compression for LLM Attention

Hong Yankun, Li Xing, Zhen Hui-Ling, Yu Xianzhi, Liu Wulong, Yuan Mingxuan

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14553 2025-02-21 cs.CL cs.AI cs.LG 85%

Multiscale Byte Language Models -- A Hierarchical Architecture for Causal Million-Length Sequence Modeling

Eric Egli, Matteo Manica, Jannis Born

专题命中 效率与部署 :language model(title,abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14328 2025-02-21 cs.SE 85%

SolSearch: An LLM-Driven Framework for Efficient SAT-Solving Code Generation

Junjie Sheng, Yanqiu Lin, Jiehao Wu, Yanhong Huang, Jianqi Shi, Min Zhang, Xiangfeng Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14008 2025-02-21 cs.CL cs.AI cs.LG 85%

MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures

Jiayu Qin, Jianchao Tan, Kefeng Zhang, Xunliang Cai, Wei Wang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04323 2025-02-21 cs.DC 85%

SCOOT: SLO-Oriented Performance Tuning for LLM Inference Engines

Ke Cheng, Zhi Wang, Wen Hu, Tiannuo Yang, Jianguo Li, Sheng Zhang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by The ACM Web Conference 2025 (WWW'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12947 2025-02-19 cs.CL cs.AI cs.LG 85%

Every Expert Matters: Towards Effective Knowledge Distillation for Mixture-of-Experts Language Models

Gyeongman Kim, Gyouk Chu, Eunho Yang

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12559 2025-02-19 cs.DC 85%

Distributed On-Device LLM Inference With Over-the-Air Computation

Kai Zhang, Hengtao He, Shenghui Song, Jun Zhang, Khaled B. Letaief

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05002 2025-02-19 cs.SE 85%

An Empirical Study on Challenges for LLM Application Developers

Xiang Chen, Chaoyang Gao, Chunyang Chen, Guangbei Zhang, Yong Liu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by ACM Transactions on Software Engineering and Methodology

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10659 2025-02-18 cs.AR 85%

Pushing up to the Limit of Memory Bandwidth and Capacity Utilization for Efficient LLM Decoding on Embedded FPGA

Jindong Li, Tenglong Li, Guobin Shen, Dongcheng Zhao, Qian Zhang, Yi Zeng

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by DATE2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15188 2025-02-06 cs.CL cs.AI cs.CV cs.LG 85%

LMFusion: Adapting Pretrained Language Models for Multimodal Generation

Weijia Shi, Xiaochuang Han, Chunting Zhou, Weixin Liang, Xi Victoria Lin, Luke Zettlemoyer, Lili Yu

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Name change: LlamaFusion to LMFusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02412 2025-02-05 cs.SE 85%

AI-Powered, But Power-Hungry? Energy Efficiency of LLM-Generated Code

Lola Solovyeva, Sophie Weidmann, Fernando Castor

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01827 2025-02-05 cs.IT math.IT 85%

Relatively-Secure LLM-Based Steganography via Constrained Markov Decision Processes

Yu-Shin Huang, Chao Tian, Krishna Narayanan, Lizhong Zheng

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13382 2025-02-04 cs.CV 85%

VTG-LLM: Integrating Timestamp Knowledge into Video LLMs for Enhanced Video Temporal Grounding

Yongxin Guo, Jingyu Liu, Mingda Li, Dingxin Cheng, Xiaoying Tang, Dianbo Sui, Qingbin Liu, Xi Chen, Kevin Zhao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16372 2025-01-29 cs.LG cs.AI cs.CL 85%

Low-Rank Adapters Meet Neural Architecture Search for LLM Compression

J. Pablo Muñoz, Jinjie Yuan, Nilesh Jain

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments AAAI-25 Workshop on Connecting Low-rank Representations in AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15829 2025-01-28 cs.DC 85%

Aging-aware CPU Core Management for Embodied Carbon Amortization in Cloud LLM Inference

Tharindu B. Hewage, Shashikant Ilager, Maria Rodriguez Read, Rajkumar Buyya

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12692 2025-01-27 cs.PF 85%

SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference

Jiho Shin, Hoeseok Yang, Youngmin Yi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12128 2025-01-22 cs.RO cs.HC 85%

Evaluating Efficiency and Engagement in Scripted and LLM-Enhanced Human-Robot Interactions

Tim Schreiter, Jens V. Rüppel, Rishi Hazra, Andrey Rudenko, Martin Magnusson, Achim J. Lilienthal

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted as a Late-Breaking Report to the 2025, 20th ACM/IEEE International Conference on Human-Robot Interaction (HRI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11864 2025-01-22 cs.SE 85%

LLM-Agents Driven Automated Simulation Testing and Analysis of small Uncrewed Aerial Systems

Venkata Sai Aswath Duvvuru, Bohan Zhang, Michael Vierhauser, Ankit Agrawal

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted as full paper at ICSE-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09367 2025-01-17 cs.DC 85%

PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks

Huiyou Zhan, Xuan Zhang, Haisheng Tan, Han Tian, Dongping Yong, Junyang Zhang, Xiang-Yang Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08262 2025-01-15 cs.CY 85%

Addressing the sustainable AI trilemma: a case study on LLM agents and RAG

Hui Wu, Xiaoyang Wang, Zhong Fan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08275 2025-01-10 cs.CR cs.SE 85%

Harnessing the Power of LLM to Support Binary Taint Analysis

Puzhuo Liu, Chengnian Sun, Yaowen Zheng, Xuan Feng, Chuan Qin, Yuncheng Wang, Zhenyang Xu, Zhi Li, Peng Di, Yu Jiang, Limin Sun

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 36 pages,16 figures

Journal ref TOSEM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13510 2025-01-08 cs.DC cs.SY eess.SY 85%

Intelligent Router for LLM Workloads: Improving Performance Through Workload-Aware Load Balancing

Kunal Jain, Anjaly Parayil, Ankur Mallick, Esha Choukse, Xiaoting Qin, Jue Zhang, Íñigo Goiri, Rujia Wang, Chetan Bansal, Victor Rühle, Anoop Kulkarni, Steve Kofsky, Saravan Rajmohan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06024 2024-12-25 cs.HC 85%

Thinking Assistants: LLM-Based Conversational Assistants that Help Users Think By Asking rather than Answering

Soya Park, Hari Subramonyam, Chinmay Kulkarni

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏