arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2502.11059 2025-02-18 cs.LG cs.AI 91%

ClimateLLM: Efficient Weather Forecasting via Frequency-Aware Large Language Models

Shixuan Li, Wei Yang, Peiyu Zhang, Xiongye Xiao, Defu Cao, Yuehan Qin, Xiaole Zhang, Yue Zhao, Paul Bogdan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13987 2025-01-27 cs.LG cs.AI 91%

OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting

Xing Hu, Yuan Cheng, Dawei Yang, Zukang Xu, Zhihang Yuan, Jiangyong Yu, Chen Xu, Zhe Jiang, Sifan Zhou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments 10 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11031 2025-01-22 cs.SE cs.AI cs.CL 91%

AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model

Lipeng Ma, Weidong Yang, Yixuan Li, Ben Fei, Mingjie Zhou, Shuhao Li, Sihang Jiang, Bo Xu, Yanghua Xiao

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16300 2024-12-20 cs.CL cs.AI 91%

BayLing 2: A Multilingual Large Language Model with Efficient Language Alignment

Shaolei Zhang, Kehao Zhang, Qingkai Fang, Shoutao Guo, Yan Zhou, Xiaodong Liu, Yang Feng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);instruction tuning(abstract)

Comments BayLing 2's online demo: http://nlp.ict.ac.cn/bayling/demo. BayLing 2's code and models: https://github.com/ictnlp/BayLing

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02224 2024-12-17 cs.CL cs.AI 91%

FedMKT: Federated Mutual Knowledge Transfer for Large and Small Language Models

Tao Fan, Guoqiang Ma, Yan Kang, Hanlin Gu, Yuanfeng Song, Lixin Fan, Kai Chen, Qiang Yang

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07762 2024-12-13 cs.LG cs.AI 91%

ASER: Activation Smoothing and Error Reconstruction for Large Language Model Quantization

Weibo Zhao, Yubin Shi, Xinyu Lyu, Wanchen Sui, Shen Li, Yong Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments Accepted at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06062 2024-11-27 cs.CL cs.CR cs.LG 91%

Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration

Wenjie Fu, Huandong Wang, Chen Gao, Guanghua Liu, Yong Li, Tao Jiang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Repo: NeurIPS2024_SPV-MIA" target="_blank" rel="noopener">https://github.com/tsinghua-fib-lab/NeurIPS2024_SPV-MIA

Journal ref The Thirty-eighth Annual Conference on Neural Information Processing Systems (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18886 2024-11-05 cs.LG cs.AI math.OC stat.ML 91%

Compressing Large Language Models using Low Rank and Low Precision Decomposition

Rajarshi Saha, Naomi Sagan, Varun Srivastava, Andrea J. Goldsmith, Mert Pilanci

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments Accepted to The 38th Conference on Neural Information Processing Systems (NeurIPS 2024). [31 pages, 10 figures, 9 tables]

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02370 2024-11-01 cs.LG cs.CL 91%

AutoTimes: Autoregressive Time Series Forecasters via Large Language Models

Yong Liu, Guo Qin, Xiangdong Huang, Jianmin Wang, Mingsheng Long

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16215 2024-10-22 cs.CL cs.AI 91%

Pre-training Distillation for Large Language Models: A Design Space Exploration

Hao Peng, Xin Lv, Yushi Bai, Zijun Yao, Jiajie Zhang, Lei Hou, Juanzi Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10382 2024-10-08 cs.AI cs.CL 91%

Efficient Prompting for LLM-based Generative Internet of Things

Bin Xiao, Burak Kantarci, Jiawen Kang, Dusit Niyato, Mohsen Guizani

专题命中 效率与部署 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments 14 pages, 11 figures. IEEE Internet of Things Journal, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02026 2024-10-04 cs.LG cs.CL 91%

Foundations of Large Language Model Compression -- Part 1: Weight Quantization

Sean I. Young

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments Preprint. 17 pages, 4 figures, 5 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08092 2024-09-24 cs.LG cs.AI cs.DC 91%

A Survey of Resource-efficient LLM and Multimodal Foundation Models

Mengwei Xu, Wangsong Yin, Dongqi Cai, Rongjie Yi, Daliang Xu, Qipeng Wang, Bingyang Wu, Yihao Zhao, Chen Yang, Shihe Wang, Qiyang Zhang, Zhenyan Lu, Li Zhang, Shangguang Wang, Yuanchun Li, Yunxin Liu, Xin Jin, Xuanzhe Liu

专题命中 效率与部署 :LLM(title,abstract);foundation model(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03735 2024-08-08 cs.CV cs.AI cs.LG 91%

Advancing Multimodal Large Language Models with Quantization-Aware Scale Learning for Efficient Adaptation

Jingjing Xie, Yuxin Zhang, Mingbao Lin, Liujuan Cao, Rongrong Ji

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments Accepted by ACMMM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11410 2024-06-19 cs.CL cs.AI 91%

HARE: HumAn pRiors, a key to small language model Efficiency

Lingyun Zhang, Bin jin, Gaojian Ge, Lunhui Liu, Xuewen Shen, Mingyong Wu, Houqian Zhang, Yongneng Jiang, Shiqi Chen, Shi Pu

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16057 2024-05-28 cs.CL cs.LG 91%

SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models

Xudong Lu, Aojun Zhou, Yuhui Xu, Renrui Zhang, Peng Gao, Hongsheng Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13551 2024-05-24 cs.LG cs.AI 91%

Large Language Models are Effective Priors for Causal Graph Discovery

Victor-Alexandru Darvariu, Stephen Hailes, Mirco Musolesi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13137 2024-03-19 cs.LG cs.CL 91%

OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models

Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, Ping Luo

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments ICLR 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08761 2024-02-15 cs.CL cs.AI 91%

JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models

Jillian Fisher, Ximing Lu, Jaehun Jung, Liwei Jiang, Zaid Harchaoui, Yejin Choi

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

Comments Code is available at https://github.com/jfisher52/JAMDecoding

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13514 2024-02-02 cs.CL cs.LG 91%

Small Language Models Improve Giants by Rewriting Their Outputs

Giorgos Vernikos, Arthur Bražinskas, Jakub Adamek, Jonathan Mallinson, Aliaksei Severyn, Eric Malmi

专题命中 效率与部署 :language model(title,abstract);small language model(title);LLM(abstract);large language model(abstract)

Comments Accepted at EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13304 2024-01-17 cs.LG cs.CL 91%

QuIP: 2-Bit Quantization of Large Language Models With Guarantees

Jerry Chee, Yaohui Cai, Volodymyr Kuleshov, Christopher De Sa

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08303 2023-12-14 cs.CL cs.AI 91%

Efficient Toxic Content Detection by Bootstrapping and Distilling Large Language Models

Jiang Zhang, Qiong Wu, Yiming Xu, Cheng Cao, Zheng Du, Konstantinos Psounis

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05736 2023-12-07 cs.CL cs.LG 91%

LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models

Huiqiang Jiang, Qianhui Wu, Chin-Yew Lin, Yuqing Yang, Lili Qiu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);prompting(abstract)

Comments Accepted at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14192 2023-10-24 cs.CL cs.AI 91%

PromptMix: A Class Boundary Augmentation Method for Large Language Model Distillation

Gaurav Sahu, Olga Vechtomova, Dzmitry Bahdanau, Issam H. Laradji

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to EMNLP 2023 (Long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14552 2023-10-24 cs.CL cs.AI 91%

Sources of Hallucination by Large Language Models on Inference Tasks

Nick McKenna, Tianyi Li, Liang Cheng, Mohammad Javad Hosseini, Mark Johnson, Mark Steedman

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02367 2026-04-06 cs.NI cs.CL 91%

Evaluating Small Language Models for Front-Door Routing: A Harmonized Benchmark and Synthetic-Traffic Experiment

评估小型语言模型用于前端路由:一个统一的基准和合成流量实验

Warren Johnson, Charles Lee

机构 * Plexor Labs(Plexor实验室) Project Autobots

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);SLM(abstract,comments);LLM(abstract)

AI总结 本文通过统一基准和合成流量实验,评估小型语言模型在前端路由中的性能,发现Qwen-2.5-3B在准确率、延迟和成本上表现优异,但整体仍存在准确率与延迟的平衡问题。

Comments 23 pages, 1 figure, 9 tables. Article 8 in the TAAC Research Series. Code and data: https://github.com/micoverde/plexor-slm-frontdoor-rct

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00625 2024-12-31 cs.LG 91%

Beyond Efficiency: A Systematic Survey of Resource-Efficient Large Language Models

Guangji Bai, Zheng Chai, Chen Ling, Shiyu Wang, Jiaying Lu, Nan Zhang, Tingwei Shi, Ziyang Yu, Mengdan Zhu, Yifei Zhang, Xinyuan Song, Carl Yang, Yue Cheng, Liang Zhao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);pretraining(abstract)

Comments GitHub repo: https://github.com/tiingweii-shii/Awesome-Resource-Efficient-LLM-Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00489 2026-08-24 cs.SE 版本更新 90%

Does My README File Need To Be Updated? Exploring LLM-Based README Maintenance

我的 README 文件需要更新吗?探索基于 LLM 的 README 维护

Haoyu Gao, Hong Yi Lin, Christoph Treude, Gregory Gay, Mansooreh Zahedi

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于 LLM 的轻量级方法,用于在人机协作流程中精准更新 README 文件,以解决文档过时问题,并通过实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04306 2026-08-18 cs.MA 版本更新 90%

Organizational Control Layer: Governance Infrastructure at the Execution Boundary of LLM Agent Systems

组织控制层:LLM代理系统执行边界的治理基础设施

Tianyu Shi, Yang Mo, Yiou Liu, Zhuonan Hao, Yin Wang, Wenzhuo Hu, Nan Yu, Meng Zhou, Jiangbo Yu

专题命中 效率与部署 :LLM(title,title_cn);prompting(abstract)

AI总结 针对LLM代理在执行边界产生的动作治理问题,提出组织控制层(OCL),通过策略执行和升级机制拦截生成动作,在不修改底层LLM生成器的情况下将不安全执行从88%降至接近零,同时将有效成功率从12%提升至96%。

Comments 13 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08485 2026-08-11 cs.AI cs.CL cs.LG 新提交 90%

HoloAegis: Frozen Representation, Topological Inference: Minimally Parametric Safety Manifolds for Zero-Shot LLM Guardrails

HoloAegis:冻结表示、拓扑推理:用于零样本大语言模型(LLM)护栏的最小参数安全流形

Tak Ho Alex Li, Kaijie Liu, Lik-Hang Lee, Kin Chung Ho, Ping Shum, Michael K. Ng

机构 * Hong Kong Baptist University(香港浸会大学) Guangdong Polytechnic Normal University(广东技术师范大学) Guangdong Institute of Digital Industry(广东数字产业研究院) The Hong Kong Polytechnic University(香港理工大学) The Education University of Hong Kong(香港教育大学) Southern University of Science and Technology(南方科技大学)

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 HoloAegis是一种最小参数拓扑推理框架,通过冻结语义表示的纯几何推理实现零样本LLM安全护栏,在8个基准测试中达到最先进准确率,兼具低延迟、零冷启动数据和跨语言迁移能力。

Comments Preprint, August 2026. 10 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏