arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22497 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22497 篇

2404.14047 2025-01-14 cs.LG 81%

An empirical study of LLaMA3 quantization: from LLMs to MLLMs

Wei Huang, Xingyu Zheng, Xudong Ma, Haotong Qin, Chengtao Lv, Hong Chen, Jie Luo, Xiaojuan Qi, Xianglong Liu, Michele Magno

机构 * The University of Hong Kong(香港大学) Beihang University(北京航空航天大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13262 2024-12-16 cs.RO cs.AI cs.HC 81%

FASTNav: Fine-tuned Adaptive Small-language-models Trained for Multi-point Robot Navigation

Yuxuan Chen, Yixin Han, Xiao Li

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Journal ref in IEEE Robotics and Automation Letters, vol. 10, no. 1, pp. 390-397, Jan. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06878 2024-12-11 cs.CV cs.LG 81%

SafeWatch: An Efficient Safety-Policy Following Video Guardrail Model with Transparent Explanations

Zhaorun Chen, Francesco Pinto, Minzhou Pan, Bo Li

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 43 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17712 2024-11-28 cs.DC cs.AI cs.NI cs.PF 81%

Generative AI on the Edge: Architecture and Performance Evaluation

Zeinab Nezami, Maryam Hafeez, Karim Djemame, Syed Ali Raza Zaidi

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13835 2024-11-08 cs.LG 81%

Active-Dormant Attention Heads: Mechanistically Demystifying Extreme-Token Phenomena in LLMs

Tianyu Guo, Druv Pai, Yu Bai, Jiantao Jiao, Michael I. Jordan, Song Mei

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09024 2024-10-31 cs.LG 81%

Aligning Diffusion Behaviors with Q-functions for Efficient Continuous Control

Huayu Chen, Kaiwen Zheng, Hang Su, Jun Zhu

专题命中 效率与部署 :LLM(abstract);language model(abstract);pretraining(abstract);preference optimization(abstract)

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21779 2024-10-30 cs.CL 81%

Leveraging LLMs for Hypothetical Deduction in Logical Inference: A Neuro-Symbolic Approach

Qingchuan Li, Jiatong Li, Tongxuan Liu, Yuting Zeng, Mingyue Cheng, Weizhe Huang, Qi Liu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13464 2024-10-18 cs.CL 81%

IterSelectTune: An Iterative Training Framework for Efficient Instruction-Tuning Data Selection

Jielin Song, Siyu Liu, Bin Zhu, Yanghui Rao

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11963 2024-10-17 cs.CV cs.AI 81%

CtrlSynth: Controllable Image Text Synthesis for Data-Efficient Multimodal Learning

Qingqing Cao, Mahyar Najibi, Sachin Mehta

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01627 2024-10-03 cs.CL 81%

Intent Detection in the Age of LLMs

Gaurav Arora, Shreya Jain, Srujana Merugu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at EMNLP 2024 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13757 2024-09-24 cs.CL 81%

Efficient Hybrid Inference for LLMs: Reward-Based Token Modelling with Selective Cloud Assistance

Adarsh MS, Jithin VG, Ditto PS

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18403 2024-08-08 cs.LG cs.CV 81%

LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning

Mingyang Zhang, Hao Chen, Chunhua Shen, Zhen Yang, Linlin Ou, Xinyi Yu, Bohan Zhuang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments accepted by acl 2024 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16207 2024-07-24 cs.CL 81%

Graph-Structured Speculative Decoding

Zhuocheng Gong, Jiahao Liu, Ziyue Wang, Pengfei Wu, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00384 2024-07-16 cs.CL 81%

BatchPrompt: Accomplish more with less

Jianzhe Lin, Maurice Diesendruck, Liang Du, Robin Abraham

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06930 2024-06-21 cs.CV cs.CL 81%

mBLIP: Efficient Bootstrapping of Multilingual Vision-LLMs

Gregor Geigle, Abhay Jain, Radu Timofte, Goran Glavaš

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments ALVR Workshop 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19299 2024-05-30 cs.CL 81%

Expert-Guided Extinction of Toxic Tokens for Debiased Generation

Xueyao Sun, Kaize Shi, Haoran Tang, Guandong Xu, Qing Li

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19041 2024-05-30 cs.CL cs.SD eess.AS 81%

BLSP-KD: Bootstrapping Language-Speech Pre-training via Knowledge Distillation

Chen Wang, Minpeng Liao, Zhongqiang Huang, Jiajun Zhang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18718 2024-05-30 cs.CL 81%

Efficient Model-agnostic Alignment via Bayesian Persuasion

Fengshuo Bai, Mingzhi Wang, Zhaowei Zhang, Boyuan Chen, Yinda Xu, Ying Wen, Yaodong Yang

专题命中 效率与部署 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13358 2024-05-24 cs.CL 81%

AdpQ: A Zero-shot Calibration Free Adaptive Post Training Quantization Method for LLMs

Alireza Ghaffari, Sharareh Younesian, Vahid Partovi Nia, Boxing Chen, Masoud Asgharian

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00801 2024-05-07 cs.CL 81%

"Ask Me Anything": How Comcast Uses LLMs to Assist Agents in Real Time

Scott Rome, Tianwen Chen, Raphael Tang, Luwei Zhou, Ferhan Ture

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03150 2024-05-03 cs.LG cs.DC cs.PF 81%

Federated Fine-Tuning of LLMs on the Very Edge: The Good, the Bad, the Ugly

Herbert Woisetschläger, Alexander Isenko, Shiqiang Wang, Ruben Mayer, Hans-Arno Jacobsen

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Camera-ready version for DEEM'24. Please cite the official ACM paper via https://doi.org/10.1145/3650203.3663331

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06174 2024-04-09 cs.AI cs.SE 81%

Cost-Efficient Prompt Engineering for Unsupervised Entity Resolution

Navapat Nananukul, Khanin Sisaengsuwanchai, Mayank Kejriwal

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14969 2024-03-19 cs.LG cs.CV 81%

Uncovering the Hidden Cost of Model Compression

Diganta Misra, Muawiz Chaudhary, Agam Goyal, Bharat Runwal, Pin Yu Chen

专题命中 效率与部署 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16840 2024-02-27 cs.CL 81%

MobiLlama: Towards Accurate and Lightweight Fully Transparent GPT

Omkar Thawakar, Ashmal Vayani, Salman Khan, Hisham Cholakal, Rao M. Anwer, Michael Felsberg, Tim Baldwin, Eric P. Xing, Fahad Shahbaz Khan

专题命中 效率与部署 :large language model(abstract);language model(abstract);small language model(abstract);SLM(abstract)

Comments Code available at : https://github.com/mbzuai-oryx/MobiLlama

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11206 2024-01-23 cs.CL 81%

InferAligner: Inference-Time Alignment for Harmlessness through Cross-Model Guidance

Pengyu Wang, Dong Zhang, Linyang Li, Chenkun Tan, Xinghao Wang, Ke Ren, Botian Jiang, Xipeng Qiu

专题命中 效率与部署 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12072 2024-01-04 cs.CL 81%

SPEED: Speculative Pipelined Execution for Efficient Decoding

Coleman Hooper, Sehoon Kim, Hiva Mohammadzadeh, Hasan Genc, Kurt Keutzer, Amir Gholami, Sophia Shao

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments NeurIPS Workshop on Efficient Natural Language and Speech Processing (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15435 2023-10-25 cs.HC cs.AI 81%

PromptInfuser: How Tightly Coupling AI and UI Design Impacts Designers' Workflows

Savvas Petridis, Michael Terry, Carrie J. Cai

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10524 2023-08-22 cs.CV cs.AI 81%

Dataset Quantization

Daquan Zhou, Kai Wang, Jianyang Gu, Xiangyu Peng, Dongze Lian, Yifan Zhang, Yang You, Jiashi Feng

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01590 2023-08-22 cs.SE cs.AI 81%

Log Parsing: How Far Can ChatGPT Go?

Van-Hoang Le, Hongyu Zhang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments This paper is accepted by ASE 2023, NIER Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14228 2023-07-04 cs.CL cs.HC 81%

GPT-3-driven pedagogical agents for training children's curious question-asking skills

Rania Abdelghani, Yen-Hsiang Wang, Xingdi Yuan, Tong Wang, Pauline Lucas, Hélène Sauzéon, Pierre-Yves Oudeyer

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏