arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22313 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22313 篇

2401.06885 2024-01-17 cs.AR cs.LG 88%

Accelerating Neural Networks for Large Language Models and Graph Processing with Silicon Photonics

Salma Afifi, Febin Sunny, Mahdi Nikdast, Sudeep Pasricha

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01699 2024-01-17 cs.CV cs.CL cs.MM 88%

WordArt Designer API: User-Driven Artistic Typography Synthesis with Large Language Models on ModelScope

Jun-Yan He, Zhi-Qi Cheng, Chenyang Li, Jingdong Sun, Wangmeng Xiang, Yusen Hu, Xianhui Lin, Xiaoyang Kang, Zengke Jin, Bin Luo, Yifeng Geng, Xuansong Xie, Jingren Zhou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Spotlight Paper at the Workshop on Machine Learning for Creativity and Design, 37th Conference on Neural Information Processing Systems (NeurIPS 2023). 5 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03385 2024-01-11 cs.CL 88%

Grimoire is All You Need for Enhancing Large Language Models

Ding Chen, Shichao Song, Qingchen Yu, Zhiyu Li, Wenjin Wang, Feiyu Xiong, Bo Tang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00893 2024-01-03 cs.SI cs.AI 88%

Social-LLM: Modeling User Behavior at Scale using Language Models and Social Network Data

Julie Jiang, Emilio Ferrara

专题命中 效率与部署 :language model(title,abstract);LLM(title);large language model(abstract);分类 cs.AI

Comments 10 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02779 2023-12-27 cs.IT cs.LG cs.NI eess.SP math.IT 88%

Large Language Models Empowered Autonomous Edge AI for Connected Intelligence

Yifei Shen, Jiawei Shao, Xinjie Zhang, Zehong Lin, Hao Pan, Dongsheng Li, Jun Zhang, Khaled B. Letaief

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments IEEE Communication Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12705 2023-12-25 cs.DC cs.AI 88%

Optimizing Distributed Training on Frontier for Large Language Models

Sajal Dash, Isaac Lyngaas, Junqi Yin, Xiao Wang, Romain Egele, Guojing Cong, Feiyi Wang, Prasanna Balaprakash

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Edited the abstract to better communicate the scope of the work

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12411 2023-12-20 cs.LG 88%

Future-proofing geotechnics workflows: accelerating problem-solving with large language models

Stephen Wu, Yu Otake, Daijiro Mizutani, Chang Liu, Kotaro Asano, Nana Sato, Hidetoshi Baba, Yusuke Fukunaga, Yosuke Higo, Akiyoshi Kamura, Shinnosuke Kodama, Masataka Metoki, Tomoka Nakamura, Yuto Nakazato, Taiga Saito, Akihiro Shioi, Masahiro Takenobu, Keigo Tsukioka, Ryo Yoshikawa

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Supplementary information will be available upon request

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11701 2023-12-20 eess.SY cs.CL cs.SY 88%

Opportunities and Challenges of Applying Large Language Models in Building Energy Efficiency and Decarbonization Studies: An Exploratory Overview

Liang Zhang, Zhelun Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14048 2023-12-20 cs.LG 88%

H$_2$O: Heavy-Hitter Oracle for Efficient Generative Inference of Large Language Models

Zhenyu Zhang, Ying Sheng, Tianyi Zhou, Tianlong Chen, Lianmin Zheng, Ruisi Cai, Zhao Song, Yuandong Tian, Christopher Ré, Clark Barrett, Zhangyang Wang, Beidi Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00407 2023-12-04 cs.CL 88%

CoLLiE: Collaborative Training of Large Language Models in an Efficient Way

Kai Lv, Shuo Zhang, Tianle Gu, Shuhao Xing, Jiawei Hong, Keyu Chen, Xiaoran Liu, Yuqing Yang, Honglin Guo, Tengxiao Liu, Yu Sun, Qipeng Guo, Hang Yan, Xipeng Qiu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments To appear at EMNLP 2023 Demo; Code is available at https://github.com/OpenLMLab/collie

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07014 2023-11-14 cs.CL cs.SD eess.AS 88%

Teach me with a Whisper: Enhancing Large Language Models for Analyzing Spoken Transcripts using Speech Embeddings

Fatema Hasan, Yulong Li, James Foulds, Shimei Pan, Bishwaranjan Bhattacharjee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09259 2023-11-03 cs.LG 88%

QUIK: Towards End-to-End 4-Bit Inference on Generative Large Language Models

Saleh Ashkboos, Ilia Markov, Elias Frantar, Tingxuan Zhong, Xincheng Wang, Jie Ren, Torsten Hoefler, Dan Alistarh

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11453 2023-10-18 cs.CL 88%

BitNet: Scaling 1-bit Transformers for Large Language Models

Hongyu Wang, Shuming Ma, Li Dong, Shaohan Huang, Huaijie Wang, Lingxiao Ma, Fan Yang, Ruiping Wang, Yi Wu, Furu Wei

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07343 2023-10-12 cs.CL 88%

How Do Large Language Models Capture the Ever-changing World Knowledge? A Review of Recent Advances

Zihan Zhang, Meng Fang, Ling Chen, Mohammad-Reza Namazi-Rad, Jun Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2023 main conference, paper link at https://github.com/hyintell/awesome-refreshing-llms

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09376 2023-08-21 cs.CL cs.HC 88%

Leveraging Large Language Models for DRL-Based Anti-Jamming Strategies in Zero Touch Networks

Abubakar S. Ali, Dimitrios Michael Manias, Abdallah Shami, Sami Muhaidat

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04241 2023-08-14 cs.AI cs.CY 88%

AutoPCF: Efficient Product Carbon Footprint Accounting with Large Language Models

Zhu Deng, Jinjie Liu, Biao Luo, Can Yuan, Qingrun Yang, Lei Xiao, Wenwen Zhou, Zhu Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13221 2023-07-26 cs.CV cs.AI cs.CE cs.DC econ.GN q-fin.EC 88%

Multilevel Large Language Models for Everyone

Yuanhao Gong

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02626 2023-05-05 cs.SE cs.AI cs.HC 88%

"Oops, Did I Just Say That?" Testing and Repairing Unethical Suggestions of Large Language Models with Suggest-Critique-Reflect Process

Pingchuan Ma, Zongjie Li, Ao Sun, Shuai Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.12512 2023-04-26 cs.AI 88%

Semantic Compression With Large Language Models

Henry Gilbert, Michael Sandborn, Douglas C. Schmidt, Jesse Spencer-Smith, Jules White

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15718 2022-10-31 cs.CL cs.IR 88%

QUILL: Query Intent with Large Language Models using Retrieval Augmentation and Multi-stage Distillation

Krishna Srinivasan, Karthik Raman, Anupam Samanta, Lingrui Liao, Luca Bertelli, Mike Bendersky

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2022 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.07682 2022-10-27 cs.CL 88%

Emergent Abilities of Large Language Models

Jason Wei, Yi Tay, Rishi Bommasani, Colin Raffel, Barret Zoph, Sebastian Borgeaud, Dani Yogatama, Maarten Bosma, Denny Zhou, Donald Metzler, Ed H. Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, William Fedus

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Transactions on Machine Learning Research (TMLR), 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.15082 2021-10-01 cs.CL 88%

Towards Efficient Post-training Quantization of Pre-trained Language Models

Haoli Bai, Lu Hou, Lifeng Shang, Xin Jiang, Irwin King, Michael R. Lyu

专题命中 效率与部署 :language model(title,abstract);post-training(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17178 2026-02-19 cs.RO 88%

Efficient Robot Design with Multi-Objective Black-Box Optimization and Large Language Models

基于多目标黑盒优化与大语言模型的高效机器人设计

Kento Kawaharazuka, Yoshiki Obinata, Naoaki Kanazawa, Haoyu Jia, Kei Okada

机构 * The University of Tokyo(东京大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(comments)

AI总结 本文提出利用大语言模型提升黑盒优化在机器人本体设计中的效率,通过结合LLMs与传统黑盒优化方法,实现更高效的解决方案探索。

Comments Accepted to IEEE Access, website: https://haraduka.github.io/urdf-llm-opt/ , video: https://www.youtube.com/watch?v=N9iMjx7of1w

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18733 2026-08-20 cs.SE cs.AI cs.LG 新提交 88%

Flama: a Python framework for development and deployment of production-ready APIs, machine learning, and LLM services

Flama:用于开发和部署生产级API、机器学习及大语言模型服务的Python框架

José A. Perdiguero López, Miguel A. Durán-Olivencia

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.AI、cs.LG

AI总结 Flama是一款开源Python框架,基于ASGI构建,统一REST API开发、ML服务与LLM推理,含七大子系统及多项内置功能,可支持多后端LLM部署等场景。

Comments 83 pages, 6 figures, 1 table. Software available at https://github.com/vortico/flama, up-to-date documentation at https://flama.dev

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18149 2026-08-20 cs.AR cs.AI cs.DC cs.LG cs.PF 新提交 88%

TokenPowerSandbox: Evidence-Gated CPU-First Screening for Energy-Aware LLM Serving

TokenPowerSandbox:面向能源感知大语言模型服务的证据门控CPU优先筛选

Chenxu Niu

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.AI、cs.LG

AI总结 TokenPowerSandbox是面向能源感知LLM服务的证据门控CPU优先筛选工作流,结合CPU投影器、GPU探测等技术,在H100上评估Qwen2.5-7B-Instruct,验证了能源与延迟预测的关联及弃权门控的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14684 2026-08-18 cs.LG cs.AI 新提交 88%

Mitigating Rubric Interference in LLM Judges via On-Policy Self-Distillation

通过策略内自蒸馏缓解大语言模型评审员中的评分标准干扰

Dingyao Yu, Tong Zhang, Yutao Mou, Yunxiao Zhang, Wei Ye, Shikun Zhang

机构 * Peking University(北京大学) Weixin Al, Tencent Inc(腾讯公司微信智能)

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.AI、cs.LG

AI总结 本研究针对LLM评审员多评分标准评估时的干扰问题,提出SARA方法,通过策略内自蒸馏提升评估一致性,且该一致性可跨数据集迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10459 2026-08-12 cs.CL cs.AI 新提交 88%

MD-ProTector: Positioning Multiple Data-Driven Prototypes for LLM-Generated Text Detection

MD-ProTector:为大语言模型生成文本检测定位多个数据驱动原型

Jinmo Han, Jimin Hong, Chanyeong Moon, Ju Yeon Kang, Seonuk Kim, Nam Soo Kim

机构 * Seoul National University(首尔大学)

专题命中 效率与部署 :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 该研究针对LLM生成文本检测的类别内部差异问题,提出MD-ProTector模型,通过原型定位损失优化,在多基准测试中取得优于同类编码器方法的检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08878 2026-08-11 cs.LG cs.AI cs.PF 新提交 88%

DistillCache: KL-Guided Adaptive KV-Cache Eviction for Memory-Efficient LLM Inference

DistillCache:基于KL引导的自适应KV缓存驱逐的内存高效大语言模型推理

Asaad Althoubi

机构 * Oklahoma State University(俄克拉荷马州立大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 DistillCache是一种强化学习框架,将KV缓存驱逐建模为序列决策问题,在25%缓存预算下,在LongBench上保留全缓存94.2%的准确率,优于多种基线方法,可提升推理吞吐量。

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02515 2026-08-10 cs.CL cs.LG 版本更新 88%

LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

LiveMem:在长期运行的大语言模型推理中维持记忆状态连续性

Zhichen Liu, Ruihan Sun, Hengjie Yang, Zipeng Wu, Zhaohan Chen, Xiaofan Zhang, Yang Xu

机构 * Southern University of Science and Technology(南方科技大学) Xidian University(西安电子科技大学)

专题命中 效率与部署 :LLM(title,summary_cn);post-training(abstract);分类 cs.CL、cs.LG

AI总结 该研究针对长期运行LLM推理中上下文切换导致状态不连续的问题,提出LiveMem方法,通过引入独立于活跃上下文的持久记忆状态,实现状态连续性,在LongMemEval等测试中表现领先。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04714 2026-08-06 cs.SE cs.AI cs.LG 新提交 88%

What We Observe as LLM Behavior Can Be a Side-effect of Inference Backend

我们所观察到的大语言模型(LLM)行为可能是推理后端的副作用

Shahed Masoudian, Passant Shafaei, Monorama Swain, Markus Schedl

专题命中 效率与部署 :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 该研究发现推理后端是影响LLM基准测试分数的不可忽视因素,约39%的分数变异性源于后端,建议披露后端信息及完整生成配置以提升结果可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏