arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22368 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22368 篇

2505.24095 2025-11-10 cs.DC 85%

SkyWalker: A Locality-Aware Cross-Region Load Balancer for LLM Inference

Tian Xia, Ziming Mao, Jamison Kerney, Ethan J. Jackson, Zhifei Li, Jiarong Xing, Scott Shenker, Ion Stoica

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09334 2025-11-07 cs.DC 85%

ThunderServe: High-performance and Cost-efficient LLM Serving in Cloud Environments

Youhe Jiang, Fangcheng Fu, Xiaozhe Yao, Taiyi Wang, Bin Cui, Ana Klimovic, Eiko Yoneki

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments MLSys 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04036 2025-11-07 cs.AR 85%

PICNIC: Silicon Photonic Interconnected Chiplets with Computational Network and In-memory Computing for LLM Inference Acceleration

Yue Jiet Chong, Yimin Wang, Zhen Wu, Xuanyao Fong

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11916 2025-11-07 cs.DC 85%

Arrow: Adaptive Scheduling Mechanisms for Disaggregated LLM Inference Architecture

Yu Wu, Tongxuan Liu, Yuting Zeng, Siyu Wu, Jun Xiong, Xianzhe Dong, Hailong Yang, Ke Zhang, Jing Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02681 2025-11-05 cs.CL cs.AI cs.LG 85%

Optimal Singular Damage: Efficient LLM Inference in Low Storage Regimes

Mohammadsajad Alipour, Mohammad Mohammadi Amiri

机构 * Department of Computer Science Rensselaer Polytechnic Institute(计算机科学系罗切斯特理工学院)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04731 2025-11-05 cs.AI cs.CL cs.LG cs.MA cs.RO 85%

Generative World Models of Tasks: LLM-Driven Hierarchical Scaffolding for Embodied Agents

Brennen Hill

机构 * Department of Computer Science University of Wisconsin-Madison(计算机科学系威斯康星大学麦迪逊分校)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments In the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Embodied World Models for Decision Making (EWM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03304 2025-11-04 cs.LG cs.AI cs.CL 85%

Harmony in Divergence: Towards Fast, Accurate, and Memory-efficient Zeroth-order LLM Fine-tuning

Qitao Tan, Jun Liu, Zheng Zhan, Caiwei Ding, Yanzhi Wang, Xiaolong Ma, Jaewoo Lee, Jin Lu, Geng Yuan

机构 * University of Georgia(佐治亚大学) Northeastern University(东北大学) University of Minnesota(明尼苏达大学) University of Arizona(亚利桑那大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08271 2025-10-31 cs.IR 85%

RecCocktail: A Generalizable and Efficient Framework for LLM-Based Recommendation

Min Hou, Chenxi Bai, Le Wu, Hao Liu, Kai Zhang, Weiwen Liu, Richang Hong, Ruiming Tang, Meng Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25297 2025-10-30 cs.SE 85%

Understanding the Characteristics of LLM-Generated Property-Based Tests in Exploring Edge Cases

Hidetake Tanaka, Haruto Tanaka, Kazumasa Shimari, Kenichi Matsumoto

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted for publication in 2nd IEEE/ACM international conference on AI-powered Software (AIware 2025) : 8 pages, 1 table, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23990 2025-10-29 cs.IR 85%

Resource-Efficient LLM Application for Structured Transformation of Unstructured Financial Contracts

Maruf Ahmed Mridul, Oshani Seneviratne

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 5 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00775 2025-10-28 cs.HC 85%

Efficiency with Rigor! A Trustworthy LLM-powered Workflow for Qualitative Data Analysis

Jie Gao, Zhiyao Shu, Shun Yi Yeo, Alok Prakash, Chien-Ming Huang, Mark Dredze, Ziang Xiao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20800 2025-10-24 cs.LG cs.AI cs.CL cs.CV 85%

Compress to Impress: Efficient LLM Adaptation Using a Single Gradient Step on 100 Samples

Shiva Sreeram, Alaa Maalouf, Pratyusha Sharma, Daniela Rus

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) University of Haifa(海法大学)

专题命中 效率与部署 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18277 2025-10-22 cs.IR 85%

Enhancing Hotel Recommendations with AI: LLM-Based Review Summarization and Query-Driven Insights

Nikolaos Belibasakis, Anastasios Giannaros, Ioanna Giannoukou, Spyros Sioutas

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20002 2025-10-22 cs.CR 85%

The Early Bird Catches the Leak: Unveiling Timing Side Channels in LLM Serving Systems

Linke Song, Zixuan Pang, Wenhao Wang, Zihao Wang, XiaoFeng Wang, Hongbo Chen, Wei Song, Yier Jin, Dan Meng, Rui Hou

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments This work was first submitted for review on Sept. 5, 2024, and the initial version was uploaded to Arxiv on Sept. 30, 2024. The latest version has accepted for publication by IEEE Transactions on Information Forensics and Security (TIFS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17393 2025-10-21 q-fin.PM 85%

3S-Trader: A Multi-LLM Framework for Adaptive Stock Scoring, Strategy, and Selection in Portfolio Optimization

Kefan Chen, Hussain Ahmad, Diksha Goel, Claudia Szabo

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16418 2025-10-21 cs.DC 85%

FourierCompress: Layer-Aware Spectral Activation Compression for Efficient and Accurate Collaborative LLM Inference

Jian Ma, Xinchen Lyu, Jun Jiang, Longhao Zou, Chenshan Ren, Qimei Cui, Xiaofeng Tao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16415 2025-10-21 cs.DC 85%

MeCeFO: Enhancing LLM Training Robustness via Fault-Tolerant Optimization

Rizhen Hu, Yutong He, Ran Yan, Mou Sun, Binghang Yuan, Kun Yuan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06807 2025-10-21 cs.CR 85%

MPCache: MPC-Friendly KV Cache Eviction for Efficient Private LLM Inference

Wenxuan Zeng, Ye Dong, Jinjin Zhou, Jin Tan, Lei Wang, Tao Wei, Runsheng Wang, Meng Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11915 2025-10-15 cs.CR 85%

Robust ML-based Detection of Conventional, LLM-Generated, and Adversarial Phishing Emails Using Advanced Text Preprocessing

Deeksha Hareesha Kulal, Chidozie Princewill Arannonu, Afsah Anwar, Nidhi Rastogi, Quamar Niyaz

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11331 2025-10-14 eess.SY cs.SY 85%

Efficient LLM Inference over Heterogeneous Edge Networks with Speculative Decoding

Bingjie Zhu, Zhixiong Chen, Liqiang Zhao, Hyundong Shin, Arumugam Nallanathan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18846 2025-10-14 cs.CR 85%

LLM-Driven APT Detection for 6G Wireless Networks: A Systematic Review and Taxonomy

Muhammed Golec, Yaser Khamayseh, Suhib Bani Melhem, Abdulmalik Alwarafy

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 22 pages, 11 figures, 8 tables. Submitted to Computer Science Review (Elsevier), May 2025

Journal ref IEEE Access 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09981 2025-10-14 cs.CV eess.IV 85%

Scaling Traffic Insights with AI and Language Model-Powered Camera Systems for Data-Driven Transportation Decision Making

Fan Zuo, Donglin Zhou, Jingqin Gao, Kaan Ozbay

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08600 2025-10-13 cs.CL cs.AI cs.LG 85%

Recover-LoRA: Data-Free Accuracy Recovery of Degraded Language Models via Low-Rank Adaptation

Devleena Das, Rajeev Patwari, Ashish Sirasao

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

专题命中 效率与部署 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07176 2025-10-09 cs.CR 85%

Exposing LLM User Privacy via Traffic Fingerprint Analysis: A Study of Privacy Risks in LLM Agent Interactions

Yixiang Zhang, Xinhao Deng, Zhongyi Gu, Yihao Chen, Ke Xu, Qi Li, Jianping Wu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 26 pages with 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06657 2025-10-09 cs.IR 85%

LLM-Powered Nuanced Video Attribute Annotation for Enhanced Recommendations

Boyuan Long, Yueqi Wang, Hiloni Mehta, Mick Zomnir, Omkar Pathak, Changping Meng, Ruolin Jia, Yajun Peng, Dapeng Hong, Xia Wu, Mingyan Gao, Onkar Dalal, Ningren Han

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments RecSys 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06222 2025-10-09 cs.HC econ.GN q-fin.EC 85%

Inducing State Anxiety in LLM Agents Reproduces Human-Like Biases in Consumer Decision-Making

Ziv Ben-Zion, Zohar Elyoseph, Tobias Spiller, Teddy Lazebnik

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Manuscript Main Text - 20 pages, including 3 Figures and 1 Table. Supplementary Materials - 10 pages, including 4 Supplemental Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04076 2025-10-07 cs.RO cs.SY eess.SY 85%

From Shadow to Light: Toward Safe and Efficient Policy Learning Across MPC, DeePC, RL, and LLM Agents

Amin Vahidi-Moghaddam, Sayed Pedram Haeri Boroujeni, Iman Jebellat, Ehsan Jebellat, Niloufar Mehrabi, Zhaojian Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03561 2025-10-07 cs.CL cs.AI cs.LG 85%

Reactive Transformer (RxT) -- Stateful Real-Time Processing for Event-Driven Reactive Language Models

Adam Filipek

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 25 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02395 2025-10-06 cs.CR cs.DC 85%

PolyLink: A Blockchain Based Decentralized Edge AI Platform for LLM Inference

Hongbo Liu, Jiannong Cao, Bo Yang, Dongbin Bai, Yinfeng Cao, Xiaoming Shen, Yinan Zhang, Jinwen Liang, Shan Jiang, Mingjin Zhang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26182 2025-10-01 cs.DC 85%

Parallax: Efficient LLM Inference Service over Decentralized Environment

Chris Tong, Youhe Jiang, Gufeng Chen, Tianyi Zhao, Sibian Lu, Wenjie Qu, Eric Yang, Lynn Ai, Binhang Yuan

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏