arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2403.02712 2024-04-04 cs.CL 70%

Breeze-7B Technical Report

Chan-Jan Hsu, Chang-Le Liu, Feng-Ting Liao, Po-Chun Hsu, Yi-Chang Chen, Da-Shan Shiu

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.11612 2024-04-03 cs.CL cs.IR 70%

Constructing Cross-lingual Consumer Health Vocabulary with Word-Embedding from Comparable User Generated Content

Chia-Hsuan Chang, Lei Wang, Christopher C. Yang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments accepted in the IEEE International Conference on Healthcare Informatics (IEEE ICHI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01327 2024-04-02 cs.CV cs.AI cs.MM 70%

Can I Trust Your Answer? Visually Grounded Video Question Answering

Junbin Xiao, Angela Yao, Yicong Li, Tat Seng Chua

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI

Comments Accepted to CVPR'24. (Compared with preprint version, we mainly improve the presentation, discuss more related works, and extend experiments in Appendix.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20127 2024-04-01 cs.AI 70%

The Impact of Prompts on Zero-Shot Detection of AI-Generated Text

Kaito Taguchi, Yujie Gu, Kouichi Sakurai

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13614 2024-03-26 cs.CV cs.AI 70%

HalluciDoctor: Mitigating Hallucinatory Toxicity in Visual Instruction Data

Qifan Yu, Juncheng Li, Longhui Wei, Liang Pang, Wentao Ye, Bosheng Qin, Siliang Tang, Qi Tian, Yueting Zhuang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15214 2024-03-25 cs.CY cs.CL cs.SI 70%

InstaSynth: Opportunities and Challenges in Generating Synthetic Instagram Data with ChatGPT for Sponsored Content Detection

Thales Bertaglia, Lily Heisig, Rishabh Kaushal, Adriana Iamnitchi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments To appear at the 18th International AAAI Conference on Web and Social Media (ICWSM 2024) -- please cite accordingly

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12145 2024-03-20 cs.CL 70%

Syn-QA2: Evaluating False Assumptions in Long-tail Questions with Synthetic QA Datasets

Ashwin Daswani, Rohan Sawant, Najoung Kim

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.19119 2024-03-18 cs.CV cs.CL 70%

VIXEN: Visual Text Comparison Network for Image Difference Captioning

Alexander Black, Jing Shi, Yifei Fan, Tu Bui, John Collomosse

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08890 2024-03-15 cs.CL cs.IT math.IT q-bio.NC 70%

From "um" to "yeah": Producing, predicting, and regulating information flow in human conversation

Claire Augusta Bergey, Simon DeDeo

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 18 pages, 4 figures, comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07356 2024-03-13 cs.CV cs.LG 70%

Premonition: Using Generative Models to Preempt Future Data Changes in Continual Learning

Mark D. McDonnell, Dong Gong, Ehsan Abbasnejad, Anton van den Hengel

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 31 pages total (14 main paper, 5 references, 12 appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06675 2024-03-12 cs.CR cs.AI cs.SE 70%

Poisoning Programs by Un-Repairing Code: Security Concerns of AI-generated Code

Cristina Improta

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at The 1st IEEE International Workshop on Reliable and Secure AI for Software Engineering (ReSAISE), co-located with ISSRE 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19620 2024-02-29 cs.RO cs.AI cs.CV 70%

Large Trajectory Models are Scalable Motion Predictors and Planners

Qiao Sun, Shiduo Zhang, Danjiao Ma, Jingzhe Shi, Derun Li, Simian Luo, Yu Wang, Ningyi Xu, Guangzhi Cao, Hang Zhao

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17936 2024-02-29 cs.CL 70%

Acquiring Linguistic Knowledge from Multimodal Input

Theodor Amariucai, Alex Warstadt

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments in Proceedings of the BabyLM Challenge at the 27th Conference on Computational Natural Language Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15175 2024-02-27 cs.LG 70%

Unified View of Grokking, Double Descent and Emergent Abilities: A Perspective from Circuits Competition

Yufei Huang, Shengding Hu, Xu Han, Zhiyuan Liu, Maosong Sun

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13583 2024-02-23 cs.CL 70%

LongWanjuan: Towards Systematic Measurement for Long Text Quality

Kai Lv, Xiaoran Liu, Qipeng Guo, Hang Yan, Conghui He, Xipeng Qiu, Dahua Lin

专题命中 预训练与数据 :language model(abstract);foundation model(abstract);分类 cs.CL

Comments Update Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13013 2024-02-21 cs.CL 70%

Code Needs Comments: Enhancing Code LLMs with Comment Augmentation

Demin Song, Honglin Guo, Yunhua Zhou, Shuhao Xing, Yudong Wang, Zifan Song, Wenwei Zhang, Qipeng Guo, Hang Yan, Xipeng Qiu, Dahua Lin

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12080 2024-02-20 cs.CL 70%

Can LLMs Compute with Reasons?

Harshit Sandilya, Peehu Raj, Jainit Sushil Bafna, Srija Mukhopadhyay, Shivansh Sharma, Ellwil Sharma, Arastu Sharma, Neeta Trivedi, Manish Shrivastava, Rajesh Kumar

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05404 2024-02-14 cs.CL 70%

Exploring the Maze of Multilingual Modeling

Sina Bagheri Nezhad, Ameeta Agrawal

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03242 2024-02-06 cs.CL 70%

JOBSKAPE: A Framework for Generating Synthetic Job Postings to Enhance Skill Matching

Antoine Magron, Anna Dai, Mike Zhang, Syrielle Montariol, Antoine Bosselut

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Published at NLP4HR 2024 (EACL Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02144 2024-02-06 cs.CL 70%

Probing Critical Learning Dynamics of PLMs for Hate Speech Detection

Sarah Masud, Mohammad Aflah Khan, Vikram Goyal, Md Shad Akhtar, Tanmoy Chakraborty

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments 20 pages, 9 figures, 14 tables. Accepted at EACL'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00235 2024-02-02 cs.CL cs.SD eess.AS 70%

Exploring the limits of decoder-only models trained on public speech recognition corpora

Ankit Gupta, George Saon, Brian Kingsbury

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17597 2024-02-01 cs.CL 70%

SPECTRUM: Speaker-Enhanced Pre-Training for Long Dialogue Summarization

Sangwoo Cho, Kaiqiang Song, Chao Zhao, Xiaoyang Wang, Dong Yu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12813 2024-01-31 cs.SE cs.LG cs.PL 70%

Automatically Testing Functional Properties of Code Translation Models

Hasan Ferit Eniser, Valentin Wüstholz, Maria Christakis

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 13 pages including appendix and references

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08957 2024-01-30 cs.CL 70%

Like a Good Nearest Neighbor: Practical Content Moderation and Text Classification

Luke Bates, Iryna Gurevych

专题命中 预训练与数据 :language model(abstract);prompting(abstract);分类 cs.CL

Comments Accepted to EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13974 2024-01-26 cs.CV cs.AI cs.GR 70%

BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models

Senthil Purushwalkam, Akash Gokul, Shafiq Joty, Nikhil Naik

专题命中 预训练与数据 :LLM(abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13598 2024-01-25 cs.CL 70%

Consistency Guided Knowledge Retrieval and Denoising in LLMs for Zero-shot Document-level Relation Triplet Extraction

Qi Sun, Kun Huang, Xiaocui Yang, Rong Tong, Kun Zhang, Soujanya Poria

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by WWW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12312 2024-01-25 cs.CL 70%

Oolong: Investigating What Makes Transfer Learning Hard with Controlled Studies

Zhengxuan Wu, Alex Tamkin, Isabel Papadimitriou

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07777 2024-01-17 cs.CL physics.comp-ph quant-ph 70%

Quantum Transfer Learning for Acceptability Judgements

Giuseppe Buonaiuto, Raffaele Guarasci, Aniello Minutolo, Giuseppe De Pietro, Massimo Esposito

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04853 2024-01-11 cs.CL 70%

Entity Recognition from Colloquial Text

Tamara Babaian, Jennifer Xu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Decision Support Systems, Volume 179, 2024,114172, ISSN 0167-9236

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02137 2024-01-05 cs.CV cs.AI 70%

SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment

Ziping Ma, Furong Xu, Jian Liu, Ming Yang, Qingpei Guo

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏