arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2310.16350 2023-10-27 cs.CL 70%

Unraveling Feature Extraction Mechanisms in Neural Networks

Xiaobing Sun, Jiaxi Li, Wei Lu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15464 2023-10-25 cs.CL 70%

Interpreting Answers to Yes-No Questions in User-Generated Content

Shivam Mathur, Keun Hee Park, Dhivya Chinnappa, Saketh Kotamraju, Eduardo Blanco

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at the Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14325 2023-10-24 cs.CL 70%

Towards Harmful Erotic Content Detection through Coreference-Driven Contextual Analysis

Inez Okulska, Emilia Wiśnios

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted for 6th Workshop on Computational Models of Reference, Anaphora and Coreference at EMNLP 2023 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13222 2023-10-23 hep-lat cond-mat.dis-nn cs.LG 70%

Equivariant Transformer is all you need

Akio Tomiya, Yuki Nagai

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 7 pages, 4 figures, contribution for the 40th International Symposium on Lattice Field Theory (Lattice 2023), July 31st - August 4th, 2023, Fermi National Accelerator Laboratory

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.01365 2023-10-20 cs.LG 70%

An Information-Theoretic Analysis of Compute-Optimal Neural Scaling Laws

Hong Jun Jeon, Benjamin Van Roy

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09652 2023-10-18 cs.CL cs.SD eess.AS 70%

The Interpreter Understands Your Meaning: End-to-end Spoken Language Understanding Aided by Speech Translation

Mutian He, Philip N. Garner

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments 16 pages, 3 figures; accepted by Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10532 2023-10-17 cs.CL 70%

One For All & All For One: Bypassing Hyperparameter Tuning with Model Averaging For Cross-Lingual Transfer

Fabian David Schmidt, Ivan Vulić, Goran Glavaš

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted to findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06303 2023-10-11 cs.RO cs.AI 70%

Dobby: A Conversational Service Robot Driven by GPT-4

Carson Stark, Bohkyung Chun, Casey Charleston, Varsha Ravi, Luis Pabon, Surya Sunkari, Tarun Mohan, Peter Stone, Justin Hart

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05380 2023-10-10 cs.IR cs.LG 70%

Augmented Embeddings for Custom Retrievals

Anirudh Khatry, Yasharth Bajpai, Priyanshu Gupta, Sumit Gulwani, Ashish Tiwari

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15954 2023-09-29 cs.CV cs.LG 70%

The Devil is in the Details: A Deep Dive into the Rabbit Hole of Data Filtering

Haichao Yu, Yu Tian, Sateesh Kumar, Linjie Yang, Heng Wang

专题命中 预训练与数据 :language model(abstract);foundation model(abstract);分类 cs.LG

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07666 2023-09-26 cs.CL 70%

ArguGPT: evaluating, understanding and identifying argumentative essays generated by GPT models

Yikang Liu, Ziyin Zhang, Wanyang Zhang, Shisen Yue, Xiaojing Zhao, Xinyuan Cheng, Yiwen Zhang, Hai Hu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08626 2023-09-19 cs.CL 70%

Improving Robustness of Neural Inverse Text Normalization via Data-Augmentation, Semi-Supervised Learning, and Post-Aligning Method

Juntae Kim, Minkyu Lim, Seokjin Hong

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments submitted to ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09435 2023-09-14 cs.CL 70%

A Methodology for Generative Spelling Correction via Natural Spelling Errors Emulation across Multiple Domains and Languages

Nikita Martynov, Mark Baushenko, Anastasia Kozlova, Katerina Kolomeytseva, Aleksandr Abramov, Alena Fenogenova

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments to appear in EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06748 2023-09-14 cs.CL cs.IR 70%

CONVERSER: Few-Shot Conversational Dense Retrieval with Synthetic Data Generation

Chao-Wei Huang, Chen-Yu Hsu, Tsu-Yuan Hsu, Chen-An Li, Yun-Nung Chen

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to SIGDIAL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14448 2023-09-12 cs.CV cs.AI 70%

ExpCLIP: Bridging Text and Facial Expressions via Semantic Alignment

Yicheng Zhong, Huawei Wei, Peiji Yang, Zhisheng Wang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03367 2023-09-08 cs.CV cs.AI 70%

Self-Supervised Masked Digital Elevation Models Encoding for Low-Resource Downstream Tasks

Priyam Mazumdar, Aiman Soliman, Volodymyr Kindratenko, Luigi Marini, Kenton McHenry

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11448 2023-08-23 cs.CV cs.LG 70%

Masked Momentum Contrastive Learning for Zero-shot Semantic Understanding

Jiantao Wu, Shentong Mo, Muhammad Awais, Sara Atito, Zhenhua Feng, Josef Kittler

专题命中 预训练与数据 :pretraining(abstract);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10758 2023-08-22 cs.CL cs.IR 70%

DepreSym: A Depression Symptom Annotated Corpus and the Role of LLMs as Assessors of Psychological Markers

Anxo Pérez, Marcos Fernández-Pichel, Javier Parapar, David E. Losada

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03805 2023-08-11 cs.LG 70%

The Emergence of Essential Sparsity in Large Pre-trained Models: The Weights that Matter

Ajay Jaiswal, Shiwei Liu, Tianlong Chen, Zhangyang Wang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Added new results on LLMs and N:M Sparsity

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09974 2023-07-25 cs.CV cs.AI eess.IV 70%

SurgicalGPT: End-to-End Language-Vision GPT for Visual Question Answering in Surgery

Lalithkumar Seenivasan, Mobarakol Islam, Gokul Kannan, Hongliang Ren

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

Comments The manuscript is accepted in MICCAI 2023. Code are available at: https://github.com/lalithjets/SurgicalGPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14795 2023-07-21 cs.CV cs.CL cs.GR 70%

MotionGPT: Human Motion as a Foreign Language

Biao Jiang, Xin Chen, Wen Liu, Jingyi Yu, Gang Yu, Tao Chen

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Project Page: https://github.com/OpenMotionLab/MotionGPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07880 2023-07-18 cs.CL 70%

Is Prompt-Based Finetuning Always Better than Vanilla Finetuning? Insights from Cross-Lingual Language Understanding

Bolei Ma, Ercong Nie, Helmut Schmid, Hinrich Schütze

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments KONVENS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02309 2023-07-13 cs.LG 70%

CodeGen2: Lessons for Training LLMs on Programming and Natural Languages

Erik Nijkamp, Hiroaki Hayashi, Caiming Xiong, Silvio Savarese, Yingbo Zhou

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09651 2023-07-12 cs.CL 70%

Cross-Lingual Retrieval Augmented Prompt for Low-Resource Languages

Ercong Nie, Sheng Liang, Helmut Schmid, Hinrich Schütze

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted to Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.00395 2023-07-04 cs.CL 70%

ELQA: A Corpus of Metalinguistic Questions and Answers about English

Shabnam Behzad, Keisuke Sakaguchi, Nathan Schneider, Amir Zeldes

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14921 2023-06-28 cs.CL cs.IR 70%

Product Information Extraction using ChatGPT

Alexander Brinkmann, Roee Shraga, Reng Chiz Der, Christian Bizer

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04667 2023-06-09 q-bio.QM cs.LG 70%

Neural Embeddings for Protein Graphs

Francesco Ceccarelli, Lorenzo Giusti, Sean B. Holden, Pietro Liò

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03978 2023-06-08 cs.CL 70%

Büyük dil modellerinin Türkçe verisetleri ile eğitilmesi ve ince ayarlanması

A. Taha Arslan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03678 2023-06-07 cs.CL 70%

On the Difference of BERT-style and CLIP-style Text Encoders

Zhihong Chen, Guiming Hardy Chen, Shizhe Diao, Xiang Wan, Benyou Wang

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments Natural Language Processing. 10 pages, 1 figure. Findings of ACL-2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03553 2023-06-07 cs.AI 70%

An Approach to Solving the Abstraction and Reasoning Corpus (ARC) Challenge

Tan John Chong Min

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏