arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-22 至 2025-10-22 共收录 42 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 42 篇

2404.12494 2025-10-22 cs.CL 89%

BIRD: A Trustworthy Bayesian Inference Framework for Large Language Models

Yu Feng, Ben Zhou, Weidong Lin, Dan Roth

机构 * University of Pennsylvania(宾夕法尼亚大学) Arizona State University(亚利桑那州立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref ICLR 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06312 2025-10-22 cs.CE 89%

Chain-of-Alpha: Unleashing the Power of Large Language Models for Alpha Mining in Quantitative Trading

Lang Cao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01472 2025-10-22 cs.CL cs.AI 88%

FALCON: Fine-grained Activation Manipulation by Contrastive Orthogonal Unalignment for Large Language Model

Jinwei Hu, Zhenglin Huang, Xiangyu Yin, Wenjie Ruan, Guangliang Cheng, Yi Dong, Xiaowei Huang

机构 * School of Computer Science and Informatics, University of Liverpool, UK(计算机科学与信息学学院,利物浦大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025 with minor revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00046 2025-10-22 cs.SE cs.AI cs.CL 88%

Exploring Data-Efficient Adaptation of Large Language Models for Code Generation

Xue Jiang, Yihong Dong, Zhiyuan Fan, Zhi Jin, Wenpin Jiao, Ge Li

机构 * Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学)) School of Computer Science, Peking University, Beijing(计算机学院(北京大学))

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by TOSEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12024 2025-10-22 cs.LG 87%

FlexQuant: A Flexible and Efficient Dynamic Precision Switching Framework for LLM Quantization

Fangxin Liu, Zongwu Wang, JinHong Xia, Junping Zhao, Shouren Zhao, Jinjin Li, Jian Liu, Li Jiang, Haibing Guan

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Shanghai Qi Zhi Institute(上海启智研究院) New York University Shanghai(纽约大学上海分校) Ant Group(蚂蚁集团) Beihang University(北航大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18672 2025-10-22 cs.LG cs.AI 86%

Reasoning Language Model Inference Serving Unveiled: An Empirical Study

Qi Li, Junpan Wu, Xiang Liu, Yuxin Wang, Zeyu Li, Zhenheng Tang, Yuhan Chen, Shaohuai Shi, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) HKBU(香港 Baptist University) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18043 2025-10-22 cs.AI 85%

CompactPrompt: A Unified Pipeline for Prompt Data Compression in LLM Workflows

Joong Ho Choi, Jiayang Zhao, Jeel Shah, Ritvika Sonawane, Vedant Singh, Avani Appalla, Will Flanagan, Filipe Condessa

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Workshop on LLMs and Generative AI for Finance at ACM ICAIF 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15926 2025-10-22 cs.AR cs.LG 85%

TeLLMe v2: An Efficient End-to-End Ternary LLM Prefill and Decode Accelerator with Table-Lookup Matmul on Edge FPGAs

Ye Qiao, Zhiheng Chen, Yifan Zhang, Yian Wang, Sitao Huang

机构 * University of California, Irvine(加州大学 Irvine 分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14162 2025-10-22 cs.IR cs.AI 85%

FinAI Data Assistant: LLM-based Financial Database Query Processing with the OpenAI Function Calling API

Juhyeong Kim, Yejin Kim, Youngbin Lee, Hyunwoo Byun

机构 * Mirae Asset Global Investments AI Quant Lab, MODULABS Seoul Republic of Korea Meritz Fire \& Marine Insurance AI Quant Lab, MODULABS Seoul Republic of Korea Elice AI Quant Lab, MODULABS Seoul Republic of Korea AI Quant Lab, MODULABS

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages, 2 figures, accepted at CIKM 2025 FinAI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17814 2025-10-22 eess.SY cs.AI cs.SY 85%

LLM Assisted Alpha Fairness for 6 GHz WiFi and NR_U Coexistence: An Agentic Orchestrator for Throughput, Energy, and SLA

Qun Wang, Yingzhou Lu, Guiran Liu, Binrong Zhu, Yang Liu

机构 * Department of Computer Science, San Francisco State University(计算机科学系,旧金山州立大学) School of Medicine, Stanford University(医学院,斯坦福大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18277 2025-10-22 cs.IR 85%

Enhancing Hotel Recommendations with AI: LLM-Based Review Summarization and Query-Driven Insights

Nikolaos Belibasakis, Anastasios Giannaros, Ioanna Giannoukou, Spyros Sioutas

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20002 2025-10-22 cs.CR 85%

The Early Bird Catches the Leak: Unveiling Timing Side Channels in LLM Serving Systems

Linke Song, Zixuan Pang, Wenhao Wang, Zihao Wang, XiaoFeng Wang, Hongbo Chen, Wei Song, Yier Jin, Dan Meng, Rui Hou

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments This work was first submitted for review on Sept. 5, 2024, and the initial version was uploaded to Arxiv on Sept. 30, 2024. The latest version has accepted for publication by IEEE Transactions on Information Forensics and Security (TIFS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03739 2025-10-22 cs.CL cs.AI 84%

VITA-Audio: Fast Interleaved Cross-Modal Token Generation for Efficient Large Speech-Language Model

Zuwei Long, Yunhang Shen, Chaoyou Fu, Heting Gao, Lijiang Li, Peixian Chen, Mengdan Zhang, Hang Shao, Jian Li, Jinlong Peng, Haoyu Cao, Ke Li, Rongrong Ji, Xing Sun

机构 * Tencent Youtu Lab(腾讯优图实验室) Nanjing University(南京大学) Xiamen University(厦门大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Training and Inference Codes: https://github.com/VITA-MLLM/VITA-Audio

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17702 2025-10-22 cs.CL 83%

Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models

Changxin Tian, Kunlong Chen, Jia Liu, Ziqi Liu, Zhiqiang Zhang, Jun Zhou

机构 * Ant Group(蚂蚁集团)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18525 2025-10-22 cs.AR 82%

From Quarter to All: Accelerating Speculative LLM Decoding via Floating-Point Exponent Remapping and Parameter Sharing

Yushu Zhao, Yubin Qin, Yang Wang, Xiaolong Yang, Huiming Han, Shaojun Wei, Yang Hu, Shouyi Yin

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05701 2025-10-22 cs.AI cs.LG 81%

Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning

Jongchan Park, Mingyu Park, Donghwan Lee

机构 * Hyundai Motor Company(现代汽车公司) KAIST(韩国科学技术院)

专题命中 效率与部署 :pretraining(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13365 2025-10-22 cs.CV cs.AI cs.LG 81%

VLLFL: A Vision-Language Model Based Lightweight Federated Learning Framework for Smart Agriculture

Long Li, Jiajia Li, Dong Chen, Lina Pu, Haibo Yao, Yanbo Huang

机构 * Department of Electrical and Computer Engineering, The University of Alabama(电气与计算机工程系,阿拉巴马大学) Electrical and Computer Engineering, Michigan State University(电气与计算机工程,密歇根州立大学) Agricultural and Biological Engineering, Mississippi State University(农业与生物工程,密苏里州立大学) Department of Computer Science, University of Alabama(计算机科学系,阿拉巴马大学) USDA-ARS Genetics and Sustainbale Agriculture(美国农业部ARS基因与可持续农业)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02672 2025-10-22 cs.CL cs.AI 79%

EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving

Shihan Dou, Ming Zhang, Chenhao Huang, Jiayi Chen, Feng Chen, Shichun Liu, Yan Liu, Chenxiao Liu, Cheng Zhong, Zongzhang Zhang, Tao Gui, Chao Xin, Chengzhi Wei, Lin Yan, Yonghui Wu, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) ByteDance Seed(字节跳动种子) Nanjing University(南京大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2025. 47 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17924 2025-10-22 cs.CL cs.AI 79%

Efficient Toxicity Detection in Gaming Chats: A Comparative Study of Embeddings, Fine-Tuned Transformers and LLMs

Yehor Tereshchenko, Mika Hämäläinen

机构 * Metropolia University of Applied Sciences(Metropolia应用科学大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Published in the Journal of Data Mining & Digital Humanities (JDMDH), special issue NLP4DH

Journal ref Journal of Data Mining & Digital Humanities, NLP4DH, October 14, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02360 2025-10-22 cs.AI cs.SE 77%

When Agents go Astray: Course-Correcting SWE Agents with PRMs

Shubham Gandhi, Jason Tsay, Jatin Ganhotra, Kiran Kate, Yara Rizk

机构 * Carnegie Mellon University(卡内基梅隆大学) IBM Research(IBM研究院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09657 2025-10-22 cs.LG 77%

Týr-the-Pruner: Structural Pruning LLMs via Global Sparsity Distribution Optimization

Guanchen Li, Yixing Xu, Zeping Li, Ji Liu, Xuanwu Yin, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18308 2025-10-22 cs.SD eess.AS 75%

ParaStyleTTS: Toward Efficient and Robust Paralinguistic Style Control for Expressive Text-to-Speech Generation

Haowei Lou, Hye-Young Paik, Wen Hu, Lina Yao

机构 * University of New South Wales(新南威尔士大学) CSIRO's Data61(澳大利亚CSIRO数据61)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17142 2025-10-22 cs.SE 75%

PEACE: Towards Efficient Project-Level Efficiency Optimization via Hybrid Code Editing

Xiaoxue Ren, Jun Wan, Yun Peng, Zhongxin Liu, Ming Liang, Dajun Chen, Wei Jiang, Yong Li

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

Journal ref ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11370 2025-10-22 cs.CL cs.AI cs.LG 75%

Stabilizing MoE Reinforcement Learning by Aligning Training and Inference Routers

Wenhan Ma, Hailin Zhang, Liang Zhao, Yifan Song, Yudong Wang, Zhifang Sui, Fuli Luo

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) LLM-Core Xiaomi(小米LLM-Core)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10806 2025-10-22 cs.CL cs.AI cs.IR cs.LG 75%

Is Implicit Knowledge Enough for LLMs? A RAG Approach for Tree-based Structures

Mihir Gupte, Paolo Giusto, Ramesh S

机构 * General Motors(通用汽车公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Waiting for Conference Response

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18467 2025-10-22 cs.LG cs.AI 73%

Simple and Efficient Heterogeneous Temporal Graph Neural Network

Yili Wang, Tairan Huang, Changlong He, Qiutong Li, Jianliang Gao

机构 * Central South University(中南大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18725 2025-10-22 cs.CL 70%

SemiAdapt and SemiLoRA: Efficient Domain Adaptation for Transformer-based Low-Resource Language Translation with a Case Study on Irish

Josh McGiff, Nikola S. Nikolov

机构 * Department of Computer Science(计算机科学系) Information Systems University of Limerick, Ireland(信息系统大学利默里克,爱尔兰)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18413 2025-10-22 cs.CL 70%

Adamas: Hadamard Sparse Attention for Efficient Long-Context Inference

Siyuan Yan, Guo-Qing Jiang, Yuchen Zhang, Xiaoxing Ma, Ran Zhu, Chun Cao, Jingwei Xu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学,中国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17727 2025-10-22 cs.LG 70%

Enabling Fine-Grained Operating Points for Black-Box LLMs

Ege Beyazit, KL Navaneet, Prashant Mathur, Roi Blanco, Vidit Bansal, Karim Bouyarmane

机构 * Amazon(亚马逊)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Under review at ICLR 2026. 36 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17858 2025-10-22 cs.CV cs.LG 70%

Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch

Xu Cai, Yang Wu, Qianli Chen, Haoran Wu, Lichuan Xiang, Hongkai Wen

机构 * AI Research Center, iHuman Inc.(人工智能研究中心,iHuman公司)

专题命中 效率与部署 :pretraining(abstract);post-training(abstract);分类 cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏