arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-03 至 2025-11-03 共收录 30 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 30 篇

2510.18477 2025-11-03 cs.AI cs.CR cs.DC cs.MA 87%

LAFA: Agentic LLM-Driven Federated Analytics over Decentralized Data Sources

Haichao Ji, Zibo Wang, Cheng Pan, Meng Han, Yifei Zhu, Dan Wang, Zhu Han

机构 * Shanghai Jiao Tong University(上海交通大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) The Hong Kong Polytechnic University(香港理工大学) University of Houston(休斯顿大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments This paper has been accepted by the 16th IEEE International Conference on Cloud Computing Technology and Science (CloudCom 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27688 2025-11-03 cs.CL cs.AI cs.LG 87%

Continuous Autoregressive Language Models

Chenze Shao, Darren Li, Fandong Meng, Jie Zhou

机构 * WeChat AI, Tencent Inc(腾讯公司微信AI实验室) Qiuzhen College, Tsinghua University(清华大学求真学院)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27556 2025-11-03 cs.CL 86%

Data-Efficient Domain Adaptation for LLM-based MT using Contrastive Preference Optimization

Inacio Vieira, Antonio Castaldo, James O'Doherty, Sheila Castilho

机构 * Alpha CRC, Cambridge, UK(Alpha CRC(英国剑桥)) University of Pisa(比萨大学) Dublin City University, Ireland(都柏林城市大学(爱尔兰))

专题命中 效率与部署 :LLM(title);preference optimization(title);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27077 2025-11-03 cs.CL 86%

Contrastive Knowledge Transfer and Robust Optimization for Secure Alignment of Large Language Models

Jiasen Zheng, Huajun Zhang, Xu Yan, Ran Hao, Chong Peng

专题命中 效率与部署 :language model(title,abstract);large language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10724 2025-11-03 cs.CL cs.LG 86%

HELIOS: Adaptive Model And Early-Exit Selection for Efficient LLM Inference Serving

Avinash Kumar, Shashank Nag, Jason Clemons, Lizy John, Poulami Das

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03717 2025-11-03 cs.LG cs.AI 86%

RaanA: A Fast, Flexible, and Data-Efficient Post-Training Quantization Algorithm

Yongyi Yang, Jianyang Gao, Wei Hu

机构 * Computer Science and Engineering, University of Michigan(密歇根大学计算机科学与工程系) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机科学与数据科学学院) Physics of Artificial Intelligence Group, NTT Research, Inc.(NTT研究所人工智能物理组)

专题命中 效率与部署 :post-training(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14815 2025-11-03 cs.CL 83%

FastLongSpeech: Enhancing Large Speech-Language Models for Efficient Long-Speech Processing

Shoutao Guo, Shaolei Zhang, Qingkai Fang, Zhengrui Ma, Min Zhang, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) School of Future Science and Engineering, Soochow University(未来科学与工程学院,苏州大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments NeurIPS 2025. The code is at https://github.com/ictnlp/FastLongSpeech. This model is at https://huggingface.co/ICTNLP/FastLongSpeech. The dataset is at https://huggingface.co/datasets/ICTNLP/LongSpeech-Eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23875 2025-11-03 cs.RO cs.AI cs.MA 83%

GenSwarm: Scalable Multi-Robot Code-Policy Generation and Deployment via Language Models

Wenkang Ji, Huaben Chen, Mingyang Chen, Guobin Zhu, Lufeng Xu, Roderich Groß, Rui Zhou, Ming Cao, Shiyu Zhao

机构 * Department of Artificial Intelligence, Westlake University(人工智能系,西湖大学) School of Automation Science and Electrical Engineering, Beihang University(自动化科学与电气工程学院,北航) Institute of Engineering and Technology, University of Groningen(工程与技术学院,格罗宁根大学) Department of Computer Science, Technical University of Darmstadt(计算机科学系,德累斯顿技术大学) School of Electrical and Electronic Engineering, The University of Sheffield(电子与电气工程学院,谢菲尔德大学)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments This article has been accepted for publication in npj Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27037 2025-11-03 cs.CL cs.AI cs.LG cs.NE 82%

Elastic Architecture Search for Efficient Language Models

Shang Wang

机构 * Indepentdent Researcher(独立研究者)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26913 2025-11-03 cs.DC 82%

FlowMesh: A Service Fabric for Composable LLM Workflows

Junyi Shen, Noppanat Wadlom, Lingfeng Zhou, Dequan Wang, Xu Miao, Lei Fang, Yao Lu

专题命中 效率与部署 :LLM(title,abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15983 2025-11-03 cs.CL cs.AI cs.LG cs.NE 82%

W-PCA Based Gradient-Free Proxy for Efficient Search of Lightweight Language Models

Shang Wang

机构 * ShanghaiTech University(上海科技大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27287 2025-11-03 cs.LG cs.AI 81%

Can LLMs Help You at Work? A Sandbox for Evaluating LLM Agents in Enterprise Environments

Harsh Vishwakarma, Ankush Agarwal, Ojas Patil, Chaitanya Devaguptapu, Mahesh Chandran

机构 * Fujitsu Research(富士通研究所)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at EMNLP 2025 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27040 2025-11-03 eess.SP cs.LG 79%

GeoPep: A geometry-aware masked language model for protein-peptide binding site prediction

Dian Chen, Yunkai Chen, Tong Lin, Sijie Chen, Xiaolin Cheng

专题命中 效率与部署 :language model(title);foundation model(abstract);分类 cs.LG

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11409 2025-11-03 cs.CL 79%

Minitron-SSM: Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning

Ali Taghibakhshi, Sharath Turuvekere Sreenivas, Saurav Muralidharan, Marcin Chochowski, Yashaswi Karnati, Raviraj Joshi, Ameya Sunil Mahabaleshwarkar, Zijia Chen, Yoshi Suhara, Oluwatobi Olabiyi, Daniel Korzekwa, Mostofa Patwary, Mohammad Shoeybi, Jan Kautz, Bryan Catanzaro, Ashwath Aithal, Nima Tajbakhsh, Pavlo Molchanov

专题命中 效率与部署 :language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13060 2025-11-03 cs.LG cs.CR 79%

AERO: Entropy-Guided Framework for Private LLM Inference

Nandan Kumar Jha, Brandon Reagen

专题命中 效率与部署 :LLM(title);language model(abstract);分类 cs.LG

Comments Revised and retitled from "AERO: Softmax-Only LLMs for Efficient Private Inference''. This version focuses on the deployable AERO pipeline (LayerNorm-free + ReLU + entropy regularization); Softmax-only variants are kept as stress-test ablations

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27583 2025-11-03 cs.PF 75%

AMD MI300X GPU Performance Analysis

Chandrish Ambati, Trung Diep

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27417 2025-11-03 cs.SE 75%

Agentic LLMs for REST API Test Amplification: A Comparative Study Across Cloud Applications

Jarne Besjes, Robbe Nooyens, Tolgahan Bardakci, Mutlu Beyazit, Serge Demeyer

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00413 2025-11-03 cs.CL cs.AI cs.LG cs.PF 75%

Accelerating Diffusion LLMs via Adaptive Parallel Decoding

Daniel Israel, Guy Van den Broeck, Aditya Grover

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27641 2025-11-03 cs.CL cs.LG cs.SY eess.SY 73%

SpecAttn: Speculating Sparse Attention

Harsh Shah

机构 * Machine Learning Department(机器学习系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to NeurIPS 2025 Workshop on Structured Probabilistic Inference & Generative Modeling

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26843 2025-11-03 cs.LG cs.AI 73%

CAS-Spec: Cascade Adaptive Self-Speculative Decoding for On-the-Fly Lossless Inference Acceleration of LLMs

Zhiyuan Ning, Jiawei Shao, Ruge Xu, Xinfei Guo, Jun Zhang, Chi Zhang, Xuelong Li

机构 * TeleAI Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 3 figures, NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15270 2025-11-03 cs.LG cs.AI cs.CV 73%

Scaling Diffusion Transformers Efficiently via $μ$P

Chenyu Zheng, Xinyu Zhang, Rongzhen Wang, Wei Huang, Zhi Tian, Weilin Huang, Jun Zhu, Chongxuan Li

机构 * Gaoling School of AI, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models(北京大型模型研究关键实验室) Engineering Research Center of Next-Generation Intelligent Search(下一代智能搜索与推荐工程研究中心) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025, 38 pages, 10 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15827 2025-11-03 cs.LG cs.AI 73%

DualOptim: Enhancing Efficacy and Stability in Machine Unlearning with Dual Optimizers

Xuyang Zhong, Haochen Luo, Chen Liu

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27206 2025-11-03 cs.AI 70%

Fints: Efficient Inference-Time Personalization for LLMs with Fine-Grained Instance-Tailored Steering

Kounianhua Du, Jianxing Liu, Kangning Zhang, Wenxiang Jiao, Yuan Lu, Jiarui Jin, Weiwen Liu, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Xiaohongshu Inc.(小红书公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17543 2025-11-03 cs.LG cs.AI cs.CL 69%

Training a Generally Curious Agent

Fahim Tajwar, Yiding Jiang, Abitha Thankaraj, Sumaita Sadia Rahman, J Zico Kolter, Jeff Schneider, Ruslan Salakhutdinov

机构 * North Carolina State University(北卡罗来纳州立大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG;LLM(comments)

Comments ICML 2025. Project Website: https://paprika-llm.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27257 2025-11-03 cs.DC 67%

Synergistic Tensor and Pipeline Parallelism

Mengshi Qi, Jiaxuan Peng, Jie Zhang, Juan Zhu, Yong Li, Huadong Ma

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14594 2025-11-03 cs.SE 67%

Small Changes, Big Trouble: Demystifying and Parsing License Variants for Incompatibility Detection in the PyPI Ecosystem

Weiwei Xu, Hengzhi Ye, Kai Gao, Minghui Zhou

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments The 48th International Conference on Software Engineering(ICSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18559 2025-11-03 cs.CV 67%

AMD-Hummingbird: Towards an Efficient Text-to-Video Model

Takashi Isobe, He Cui, Dong Zhou, Mengmeng Ge, Dong Li, Emad Barsoum

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Homepage: https://www.amd.com/en/developer/resources/technical-articles/amd-hummingbird-0-9b-text-to-video-diffusion-model-with-4-step-inferencing.html| GitHub: https://github.com/AMD-AIG-AIMA/AMD-Hummingbird-T2V

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16994 2025-11-03 cs.IR cs.AI cs.CL 62%

R$^2$ec: Towards Large Recommender Models with Reasoning

Runyang You, Yongqi Li, Xinyu Lin, Xin Zhang, Wenjie Wang, Wenjie Li, Liqiang Nie

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27401 2025-11-03 cs.HC 50%

"Koyi Sawaal Nahi Hai": Reimagining Maternal Health Chatbots for Collective, Culturally Grounded Care

Imaan Hameed, Huma Umar, Fozia Umber, Maryam Mustafa

专题命中 效率与部署 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27135 2025-11-03 cs.CV 50%

E-MMDiT: Revisiting Multimodal Diffusion Transformer Design for Fast Image Synthesis under Limited Resources

Tong Shen, Jingai Yu, Dong Zhou, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(Advanced Micro Devices公司)

专题命中 效率与部署 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏