arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22497 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22497 篇

2109.08270 2021-10-26 cs.AI cs.CL 81%

Language Models as a Knowledge Source for Cognitive Agents

Robert E. Wray, III, James R. Kirk, John E. Laird

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 16 pages, 2 figures; accepted for 2021 Advances in Cognitive Systems Conference (revised based on reviews)

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.10429 2021-10-22 cs.LG cs.CL cs.SD eess.AS 81%

Knowledge distillation from language model to acoustic model: a hierarchical multi-task learning approach

Mun-Hak Lee, Joon-Hyuk Chang

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 4page + 1page for citation + 2 pages for appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.06620 2021-10-14 cs.CL cs.LG 81%

Maximizing Efficiency of Language Model Pre-training for Learning Representation

Junmo Kang, Suwon Shin, Jeonghwan Kim, Jaeyoung Jo, Sung-Hyon Myaeng

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Published in KSC 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.02402 2021-10-07 cs.LG cs.CL 81%

Language Modeling using LMUs: 10x Better Data Efficiency or Improved Scaling Compared to Transformers

Narsimha Chilkuri, Eric Hunsberger, Aaron Voelker, Gurshaant Malik, Chris Eliasmith

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.11295 2021-09-24 cs.CL cs.LG 81%

Dynamic Knowledge Distillation for Pre-trained Language Models

Lei Li, Yankai Lin, Shuhuai Ren, Peng Li, Jie Zhou, Xu Sun

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Main Conference EMNLP 2021, Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.11292 2021-09-22 cs.CL cs.LG 81%

A Discriminative Entity-Aware Language Model for Virtual Assistants

Mandana Saebi, Ernest Pusateri, Aaksha Meghawat, Christophe Van Gysel

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments To appear in Interspeech 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.06243 2021-09-15 cs.CL cs.AI 81%

KroneckerBERT: Learning Kronecker Decomposition for Pre-trained Language Models via Knowledge Distillation

Marzieh S. Tahaei, Ella Charlaix, Vahid Partovi Nia, Ali Ghodsi, Mehdi Rezagholizadeh

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05036 2021-08-24 cs.CL cs.AI 81%

DEMix Layers: Disentangling Domains for Modular Language Modeling

Suchin Gururangan, Mike Lewis, Ari Holtzman, Noah A. Smith, Luke Zettlemoyer

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments edits: updated reference links, added related work, typo fixes

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.13686 2021-07-30 cs.CL cs.LG 81%

AutoTinyBERT: Automatic Hyper-parameter Optimization for Efficient Pre-trained Language Models

Yichun Yin, Cheng Chen, Lifeng Shang, Xin Jiang, Xiao Chen, Qun Liu

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ACL 2021. The code and models are released at https://github.com/huawei-noah/Pretrained-Language-Model/tree/master/AutoTinyBERT

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.11533 2021-06-23 cs.CL cs.AI 81%

Do Language Models Perform Generalizable Commonsense Inference?

Peifeng Wang, Filip Ilievski, Muhao Chen, Xiang Ren

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures. Accepted to ACL'21 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.06297 2021-06-14 cs.CL cs.LG 81%

Dynamic Language Models for Continuously Evolving Content

Spurthi Amba Hombaiah, Tao Chen, Mingyang Zhang, Michael Bendersky, Marc Najork

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Journal ref KDD 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.12002 2021-06-09 cs.LG cs.CL 81%

Super Tickets in Pre-Trained Language Models: From Model Compression to Improving Generalization

Chen Liang, Simiao Zuo, Minshuo Chen, Haoming Jiang, Xiaodong Liu, Pengcheng He, Tuo Zhao, Weizhu Chen

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments The 59th annual meeting of the Association for Computational Linguistics (ACL 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.11869 2021-05-28 cs.CL cs.LG 81%

AMBERT: A Pre-trained Language Model with Multi-Grained Tokenization

Xinsong Zhang, Pengshuai Li, Hang Li

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments To be appeared in Findings of ACL2021. In this version, we develop a simplified method to improve the efficiency of AMBERT in inference, which still performs better than BERT with the same computational cost as BERT

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.15023 2021-05-03 cs.CV cs.AI cs.LG 81%

Post-training deep neural network pruning via layer-wise calibration

Ivan Lazarevich, Alexander Kozlov, Nikita Malinin

专题命中 效率与部署 :post-training(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.05331 2021-04-28 cs.CL cs.AI 81%

Language Models for Lexical Inference in Context

Martin Schmitt, Hinrich Schütze

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Final version of EACL 2021 long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.01061 2021-04-16 cs.CL cs.LG 81%

Data-Efficient Pretraining via Contrastive Self-Supervision

Nils Rethmeier, Isabelle Augenstein

专题命中 效率与部署 :pretraining(title,abstract);分类 cs.CL、cs.LG

Comments Majorly reworked version. Comparison to a large-scale RoBERTa model added. Focus on learning efficiency comparison to self and RoBERTa

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.11912 2021-03-23 cs.LG cs.AI cs.CV 81%

Evaluating Post-Training Compression in GANs using Locality-Sensitive Hashing

Gonçalo Mordido, Haojin Yang, Christoph Meinel

专题命中 效率与部署 :post-training(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.09268 2021-03-08 cs.IR cs.AI cs.CL 81%

Training Large-Scale News Recommenders with Pretrained Language Models in the Loop

Shitao Xiao, Zheng Liu, Yingxia Shao, Tao Di, Xing Xie

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.13136 2021-03-01 cs.CL cs.LG 81%

Automated essay scoring using efficient transformer-based language models

Christopher M Ormerod, Akanksha Malhotra, Amir Jafari

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 11 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.11931 2021-02-12 cs.CL cs.AI 81%

Evaluating Commonsense in Pre-trained Language Models

Xuhui Zhou, Yue Zhang, Leyang Cui, Dandan Huang

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments AAAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.14659 2021-01-05 cs.CL cs.LG eess.AS stat.ML 81%

Masked Language Model Scoring

Julian Salazar, Davis Liang, Toan Q. Nguyen, Katrin Kirchhoff

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ACL 2020 camera-ready (presented July 2020)

Journal ref Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics (2020), 2699-2712

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.04640 2020-11-10 cs.CL cs.LG 81%

Scaling Hidden Markov Language Models

Justin T. Chiu, Alexander M. Rush

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 9 pages, accepted as a short paper at EMNLP 2020

Journal ref EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.06823 2020-10-23 cs.CL cs.LG 81%

Real-Time Execution of Large-scale Language Models on Mobile

Wei Niu, Zhenglun Kong, Geng Yuan, Weiwen Jiang, Jiexiong Guan, Caiwen Ding, Pu Zhao, Sijia Liu, Bin Ren, Yanzhi Wang

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.06040 2020-10-15 cs.CL cs.AI 81%

Improving Self-supervised Pre-training via a Fully-Explored Masked Language Model

Mingzhi Zheng, Dinghan Shen, Yelong Shen, Weizhu Chen, Lin Xiao

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.00744 2020-10-06 cs.CL cs.AI 81%

PhoBERT: Pre-trained language models for Vietnamese

Dat Quoc Nguyen, Anh Tuan Nguyen

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

Comments EMNLP 2020 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.14167 2020-09-30 cs.CL cs.LG 81%

Contrastive Distillation on Intermediate Representations for Language Model Compression

Siqi Sun, Zhe Gan, Yu Cheng, Yuwei Fang, Shuohang Wang, Jingjing Liu

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.00177 2020-08-04 cs.LG cs.CL stat.ML 81%

Multi-node Bert-pretraining: Cost-efficient Approach

Jiahuang Lin, Xin Li, Gennady Pekhimenko

专题命中 效率与部署 :pretraining(title);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.07877 2020-05-19 cs.CL cs.LG 81%

MicroNet for Efficient Language Modeling

Zhongxia Yan, Hanrui Wang, Demi Guo, Song Han

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by PMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.03588 2020-05-04 cs.CL cs.LG 81%

MKD: a Multi-Task Knowledge Distillation Approach for Pretrained Language Models

Linqing Liu, Huan Wang, Jimmy Lin, Richard Socher, Caiming Xiong

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.05315 2020-01-16 cs.CL cs.LG 81%

A Continuous Space Neural Language Model for Bengali Language

Hemayet Ahmed Chowdhury, Md. Azizul Haque Imon, Anisur Rahman, Aisha Khatun, Md. Saiful Islam

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏