arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22405 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22405 篇

2404.15604 2024-04-25 cs.CL cs.AI 84%

Hybrid LLM/Rule-based Approaches to Business Insights Generation from Structured Data

Aliaksei Vertsel, Mikhail Rumiantsau

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09741 2024-04-05 cs.CL cs.LG 84%

P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models

Yuhan Liu, Shangbin Feng, Xiaochuang Han, Vidhisha Balachandran, Chan Young Park, Sachin Kumar, Yulia Tsvetkov

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02389 2024-04-04 cs.CL cs.AI 84%

On Linearizing Structured Data in Encoder-Decoder Language Models: Insights from Text-to-SQL

Yutong Shao, Ndapa Nakashole

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments to appear at NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17343 2024-04-01 cs.CV cs.CL cs.LG 84%

Residual-based Language Models are Free Boosters for Biomedical Imaging

Zhixin Lai, Jing Wu, Suiyao Chen, Yucheng Zhou, Naira Hovakimyan

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17811 2024-03-27 cs.LG cs.CL 84%

Are Compressed Language Models Less Subgroup Robust?

Leonidas Gee, Andrea Zugarini, Novi Quadrianto

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments The 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP 2023)

Journal ref Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing: Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17244 2024-03-22 cs.LG cs.CL 84%

The LLM Surgeon

Tycho F. A. van der Ouderaa, Markus Nagel, Mart van Baalen, Yuki M. Asano, Tijmen Blankevoort

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07816 2024-03-13 cs.CL cs.AI 84%

Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM

Sainbayar Sukhbaatar, Olga Golovneva, Vasu Sharma, Hu Xu, Xi Victoria Lin, Baptiste Rozière, Jacob Kahn, Daniel Li, Wen-tau Yih, Jason Weston, Xian Li

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04792 2024-03-11 cs.CL cs.LG 84%

Breaking the Language Barrier: Can Direct Inference Outperform Pre-Translation in Multilingual LLM Applications?

Yotam Intrator, Matan Halfon, Roman Goldenberg, Reut Tsarfaty, Matan Eyal, Ehud Rivlin, Yossi Matias, Natalia Aizenberg

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01136 2024-03-05 cs.LG cs.AI cs.DC 84%

LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization

Juntao Zhao, Borui Wan, Yanghua Peng, Haibin Lin, Chuan Wu

专题命中 效率与部署 :LLM(title,abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15337 2024-03-05 cs.CL cs.AI 84%

Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation

Xuefei Ning, Zinan Lin, Zixuan Zhou, Zifu Wang, Huazhong Yang, Yu Wang

专题命中 效率与部署 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments In ICLR'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00745 2024-03-04 cs.LG cs.CL 84%

AtP*: An efficient and scalable method for localizing LLM behaviour to components

János Kramár, Tom Lieberum, Rohin Shah, Neel Nanda

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06262 2024-02-20 cs.CL cs.AI 84%

On the Efficacy of Eviction Policy for Key-Value Constrained Generative Language Model Inference

Siyu Ren, Kenny Q. Zhu

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10597 2024-02-19 cs.CL cs.AI 84%

Efficiency at Scale: Investigating the Performance of Diminutive Language Models in Clinical Tasks

Niall Taylor, Upamanyu Ghose, Omid Rohanian, Mohammadmahdi Nouriborji, Andrey Kormilitzin, David Clifton, Alejo Nevado-Holgado

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08075 2024-02-14 q-bio.GN cs.AI cs.LG 84%

Efficient and Scalable Fine-Tune of Language Models for Genome Understanding

Huixin Zhan, Ying Nian Wu, Zijun Zhang

专题命中 效率与部署 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08345 2024-02-12 cs.CL cs.AI 84%

Data Distribution Bottlenecks in Grounding Language Models to Knowledge Bases

Yiheng Shu, Zhiwei Yu

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15347 2024-01-30 cs.CL cs.AI 84%

A Comprehensive Survey of Compression Algorithms for Language Models

Seungcheol Park, Jaehyeon Choi, Sojin Lee, U Kang

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14559 2024-01-29 cs.CL cs.AI cs.HC cs.IR 84%

Language Modelling Approaches to Adaptive Machine Translation

Yasmin Moslem

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17238 2023-12-29 cs.LG cs.AI cs.DC 84%

Fast Inference of Mixture-of-Experts Language Models with Offloading

Artyom Eliseev, Denis Mazur

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16119 2023-12-27 cs.LG cs.CL cs.NE 84%

A bi-objective $ε$-constrained framework for quality-cost optimization in language model ensembles

Aditi Singla, Aditya Singh, Kanishk Kukreja

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12458 2023-12-21 cs.CL cs.AI 84%

When Parameter-efficient Tuning Meets General-purpose Vision-language Models

Yihang Zhai, Haixin Wang, Jianlong Chang, Xinlong Yang, Jinan Sun, Shikun Zhang, Qi Tian

专题命中 效率与部署 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11420 2023-12-19 cs.CL cs.AI cs.CV 84%

Tuning LayerNorm in Attention: Towards Efficient Multi-Modal LLM Finetuning

Bingchen Zhao, Haoqin Tu, Chen Wei, Jieru Mei, Cihang Xie

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16934 2023-10-31 cs.CV cs.CL cs.CR cs.LG cs.MM 84%

On Evaluating Adversarial Robustness of Large Vision-Language Models

Yunqing Zhao, Tianyu Pang, Chao Du, Xiao Yang, Chongxuan Li, Ngai-Man Cheung, Min Lin

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08797 2023-10-16 cs.CL cs.AI 84%

A Comparative Analysis of Task-Agnostic Distillation Methods for Compressing Transformer Language Models

Takuma Udagawa, Aashka Trivedi, Michele Merler, Bishwaranjan Bhattacharjee

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2023 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07188 2023-10-12 cs.CL cs.AI 84%

Adaptive Gating in Mixture-of-Experts based Language Models

Jiamin Li, Qiang Su, Yitao Yang, Yimin Jiang, Cong Wang, Hong Xu

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06846 2023-10-12 cs.AI cs.CL 84%

Exploiting Language Models as a Source of Knowledge for Cognitive Agents

James R. Kirk, Robert E. Wray, John E. Laird

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 4 figures, 2 tables. AAAI FSS on Integrating Cognitive Architecture and Generative Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00092 2023-10-03 cs.CL cs.AI cs.HC 84%

Voice2Action: Language Models as Agent for Efficient Real-Time Interaction in Virtual Reality

Yang Su

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16058 2023-09-29 cs.LG cs.CL cs.CV 84%

AnyMAL: An Efficient and Scalable Any-Modality Augmented Language Model

Seungwhan Moon, Andrea Madotto, Zhaojiang Lin, Tushar Nagarajan, Matt Smith, Shashank Jain, Chun-Fu Yeh, Prakash Murugesan, Peyman Heidari, Yue Liu, Kavya Srinet, Babak Damavandi, Anuj Kumar

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17118 2023-08-30 cs.LG cs.CL 84%

Scissorhands: Exploiting the Persistence of Importance Hypothesis for LLM KV Cache Compression at Test Time

Zichang Liu, Aditya Desai, Fangshuo Liao, Weitao Wang, Victor Xie, Zhaozhuo Xu, Anastasios Kyrillidis, Anshumali Shrivastava

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05972 2023-07-13 cs.CL cs.LG 84%

Self-Distilled Quantization: Achieving High Compression Rates in Transformer-Based Language Models

James O' Neill, Sourav Dutta

专题命中 效率与部署 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00014 2023-06-02 cs.CL cs.LG 84%

PreQuant: A Task-agnostic Quantization Approach for Pre-trained Language Models

Zhuocheng Gong, Jiahao Liu, Qifan Wang, Yang Yang, Jingang Wang, Wei Wu, Yunsen Xian, Dongyan Zhao, Rui Yan

专题命中 效率与部署 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.LG

Comments Findings of ACL2023

详情

展开后加载摘要…

URL PDF HTML 收藏