arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12486 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2305.02239 2023-10-24 cs.CL cs.AI 73%

The Benefits of Label-Description Training for Zero-Shot Text Classification

Lingyu Gao, Debanjan Ghosh, Kevin Gimpel

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted at the EMNLP 2023 main conference (long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14108 2023-10-24 cs.LG cs.AI cs.CV 73%

CLIP meets Model Zoo Experts: Pseudo-Supervision for Visual Enhancement

Mohammadreza Salehi, Mehrdad Farajtabar, Maxwell Horton, Fartash Faghri, Hadi Pouransari, Raviteja Vemulapalli, Oncel Tuzel, Ali Farhadi, Mohammad Rastegari, Sachin Mehta

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13006 2023-10-23 cs.SE cs.AI cs.IR cs.LG 73%

Software Metadata Classification based on Generative Artificial Intelligence

Seetharam Killivalavan, Durairaj Thenmozhi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments FIRE Track: Information Retrieval in Software Engineering (IRSE), 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.11649 2023-10-19 cs.RO cs.AI cs.CL cs.FL 73%

Grounding Complex Natural Language Commands for Temporal Tasks in Unseen Environments

Jason Xinyu Liu, Ziyi Yang, Ifrah Idrees, Sam Liang, Benjamin Schornstein, Stefanie Tellex, Ankit Shah

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Conference on Robot Learning 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16424 2023-09-29 cs.CL cs.AI cs.SI 73%

Prompt-and-Align: Prompt-Based Social Alignment for Few-Shot Fake News Detection

Jiaying Wu, Shen Li, Ailin Deng, Miao Xiong, Bryan Hooi

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted to CIKM 2023 (Full Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14091 2023-09-29 cs.CL cs.AI 73%

Revisiting Acceptability Judgements

Hai Hu, Ziyin Zhang, Weifang Huang, Jackie Yan-Ki Lai, Aini Li, Yina Patterson, Jiahui Huang, Peng Zhang, Chien-Jer Charles Lin, Rui Wang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05668 2023-09-13 cs.CL cs.AI 73%

Studying the impacts of pre-training using ChatGPT-generated text on downstream tasks

Sarthak Anand

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Master's thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10802 2023-09-06 cs.CR cs.CL cs.LG 73%

Combing for Credentials: Active Pattern Extraction from Smart Reply

Bargav Jayaraman, Esha Ghosh, Melissa Chase, Sambuddha Roy, Wei Dai, David Evans

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00638 2023-09-06 q-fin.TR cs.AI cs.LG q-fin.CP 73%

Generative AI for End-to-End Limit Order Book Modelling: A Token-Level Autoregressive Generative Model of Message Flow Using a Deep State Space Network

Peer Nagy, Sascha Frey, Silvia Sapora, Kang Li, Anisoara Calinescu, Stefan Zohren, Jakob Foerster

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13517 2023-08-28 cs.CL cs.AI 73%

ChatGPT as Data Augmentation for Compositional Generalization: A Case Study in Open Intent Detection

Yihao Fang, Xianzhi Li, Stephen W. Thomas, Xiaodan Zhu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the Joint Workshop of the 5th Financial Technology and Natural Language Processing (FinNLP) and 2nd Multimodal AI For Financial Forecasting (Muffin), Macao, August 20, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.07240 2023-08-25 cs.CV cs.AI cs.LG 73%

Test-Time Adaptation for Visual Document Understanding

Sayna Ebrahimi, Sercan O. Arik, Tomas Pfister

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted at TMLR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.01066 2023-08-15 cs.CL cs.LG 73%

What Can Transformers Learn In-Context? A Case Study of Simple Function Classes

Shivam Garg, Dimitris Tsipras, Percy Liang, Gregory Valiant

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12820 2023-08-09 cs.CL cs.AI 73%

MultiTabQA: Generating Tabular Answers for Multi-Table Question Answering

Vaishali Pal, Andrew Yates, Evangelos Kanoulas, Maarten de Rijke

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ACL-2023

Journal ref In Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), 2023, pages 6322-6334, Toronto, Canada. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15818 2023-08-01 cs.RO cs.CL cs.CV cs.LG 73%

RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control

Anthony Brohan, Noah Brown, Justice Carbajal, Yevgen Chebotar, Xi Chen, Krzysztof Choromanski, Tianli Ding, Danny Driess, Avinava Dubey, Chelsea Finn, Pete Florence, Chuyuan Fu, Montse Gonzalez Arenas, Keerthana Gopalakrishnan, Kehang Han, Karol Hausman, Alexander Herzog, Jasmine Hsu, Brian Ichter, Alex Irpan, Nikhil Joshi, Ryan Julian, Dmitry Kalashnikov, Yuheng Kuang, Isabel Leal, Lisa Lee, Tsang-Wei Edward Lee, Sergey Levine, Yao Lu, Henryk Michalewski, Igor Mordatch, Karl Pertsch, Kanishka Rao, Krista Reymann, Michael Ryoo, Grecia Salazar, Pannag Sanketi, Pierre Sermanet, Jaspiar Singh, Anikait Singh, Radu Soricut, Huong Tran, Vincent Vanhoucke, Quan Vuong, Ayzaan Wahid, Stefan Welker, Paul Wohlhart, Jialin Wu, Fei Xia, Ted Xiao, Peng Xu, Sichun Xu, Tianhe Yu, Brianna Zitkovich

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Website: https://robotics-transformer.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02486 2023-07-20 cs.CL cs.LG 73%

LongNet: Scaling Transformers to 1,000,000,000 Tokens

Jiayu Ding, Shuming Ma, Li Dong, Xingxing Zhang, Shaohan Huang, Wenhui Wang, Nanning Zheng, Furu Wei

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10444 2023-06-21 cs.CL cs.AI 73%

Universal Information Extraction with Meta-Pretrained Self-Retrieval

Xin Cong. Bowen Yu, Mengcheng Fang, Tingwen Liu, Haiyang Yu, Zhongkai Hu, Fei Huang, Yongbin Li, Bin Wang

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02555 2023-06-21 cs.LG cs.AI cs.CY cs.HC 73%

Should ChatGPT and Bard Share Revenue with Their Data Providers? A New Business Model for the AI Era

Dong Zhang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 22 pages, 8 figures, 2 tables, Published in Advances in Artificial Intelligence and Machine Learning, minor revision made

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09594 2023-06-19 cs.CL cs.AI 73%

CMLM-CSE: Based on Conditional MLM Contrastive Learning for Sentence Embeddings

Wei Zhang, Xu Chen

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07790 2023-06-14 cs.CL cs.AI 73%

NoCoLA: The Norwegian Corpus of Linguistic Acceptability

Matias Jentoft, David Samuel

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published at NoDaLiDa 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04835 2023-06-12 cs.CL cs.AI 73%

How Do In-Context Examples Affect Compositional Generalization?

Shengnan An, Zeqi Lin, Qiang Fu, Bei Chen, Nanning Zheng, Jian-Guang Lou, Dongmei Zhang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2023 main conference, long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04787 2023-06-09 cs.CL cs.LG 73%

Absformer: Transformer-based Model for Unsupervised Multi-Document Abstractive Summarization

Mohamed Trabelsi, Huseyin Uzunalioglu

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments ICDAR 2023 International Workshop on Machine Learning (WML)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02978 2023-06-06 cs.CL cs.AI 73%

Which Argumentative Aspects of Hate Speech in Social Media can be reliably identified?

Damián Furman, Pablo Torres, José A. Rodríguez, Diego Letzen, Vanina Martínez, Laura Alonso Alemany

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 Pages plus reference and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09865 2023-06-06 cs.CL cs.AI 73%

Z-ICL: Zero-Shot In-Context Learning with Pseudo-Demonstrations

Xinxi Lyu, Sewon Min, Iz Beltagy, Luke Zettlemoyer, Hannaneh Hajishirzi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages; 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18623 2023-05-31 cs.LG cs.CL 73%

Alfred: A System for Prompted Weak Supervision

Peilin Yu, Stephen H. Bach

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments ACL 2023 System Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12740 2023-05-30 cs.LG cs.AI 73%

Masked Autoencoding for Scalable and Generalizable Decision Making

Fangchen Liu, Hao Liu, Aditya Grover, Pieter Abbeel

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06358 2023-05-12 cs.AI cs.CL 73%

Accessible Instruction-Following Agent

Kairui Zhou

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.08810 2023-05-11 cs.PL cs.CL cs.LG cs.SE 73%

GAP-Gen: Guided Automatic Python Code Generation

Junchen Zhao, Yurun Song, Junlin Wang, Ian G. Harris

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Proceedings of the 17th Conference of the European Chapter of the Association for Computational Linguistics: Student Research Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.15259 2023-05-10 cs.LG cs.AI cs.CR 73%

On the Impossible Safety of Large AI Models

El-Mahdi El-Mhamdi, Sadegh Farhadkhani, Rachid Guerraoui, Nirupam Gupta, Lê-Nguyên Hoang, Rafael Pinot, Sébastien Rouault, John Stephan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13518 2023-03-24 cs.CV cs.AI cs.LG 73%

Three ways to improve feature alignment for open vocabulary detection

Relja Arandjelović, Alex Andonian, Arthur Mensch, Olivier J. Hénaff, Jean-Baptiste Alayrac, Andrew Zisserman

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12860 2023-03-24 cs.CL cs.AI 73%

Salient Span Masking for Temporal Understanding

Jeremy R. Cole, Aditi Chaudhary, Bhuwan Dhingra, Partha Talukdar

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments 5 pages 1 figure, to appear in EACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏