arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 139420 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2404.03683 2024-04-08 cs.LG cs.AI cs.CL 75%

Stream of Search (SoS): Learning to Search in Language

Kanishk Gandhi, Denise Lee, Gabriel Grand, Muxin Liu, Winson Cheng, Archit Sharma, Noah D. Goodman

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01317 2024-04-03 cs.CL cs.AI cs.LG 75%

Intelligent Learning Rate Distribution to reduce Catastrophic Forgetting in Transformers

Philip Kenneweg, Alexander Schulz, Sarah Schröder, Barbara Hammer

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00532 2024-04-02 cs.CV 75%

LLMs are Good Action Recognizers

Haoxuan Qu, Yujun Cai, Jun Liu

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16558 2024-04-01 cs.CV 75%

Elysium: Exploring Object-level Perception in Videos via MLLM

Han Wang, Yanjie Wang, Yongjie Ye, Yuxiang Nie, Can Huang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17582 2024-03-27 cs.CL cs.AI cs.LG 75%

Towards a Zero-Data, Controllable, Adaptive Dialog System

Dirk Väth, Lindsey Vanderlyn, Ngoc Thang Vu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16571 2024-03-26 cs.CL cs.AI cs.LG 75%

NSINA: A News Corpus for Sinhala

Hansi Hettiarachchi, Damith Premasiri, Lasitha Uyangodage, Tharindu Ranasinghe

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to LREC-COLING 2024 (The 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02969 2024-03-26 cs.CV 75%

Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception

Junwen He, Yifan Wang, Lijun Wang, Huchuan Lu, Jun-Yan He, Jin-Peng Lan, Bin Luo, Xuansong Xie

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12375 2024-03-14 cs.CL cs.AI cs.LG 75%

In-Context Learning Learns Label Relationships but Is Not Conventional Learning

Jannik Kossen, Yarin Gal, Tom Rainforth

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04190 2024-03-08 cs.LG cs.AI cs.CL 75%

Generative AI for Synthetic Data Generation: Methods, Challenges and the Future

Xu Guo, Yiqiang Chen

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15065 2024-03-06 cs.RO cs.CV eess.IV 75%

Language-EXtended Indoor SLAM (LEXIS): A Versatile System for Real-time Visual Scene Understanding

Christina Kassab, Matias Mattamala, Lintong Zhang, Maurice Fallon

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments Accepted at ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09291 2024-02-27 cs.CV 75%

Vision-by-Language for Training-Free Compositional Image Retrieval

Shyamgopal Karthik, Karsten Roth, Massimiliano Mancini, Zeynep Akata

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07871 2024-02-13 cs.LG cs.AI cs.CL 75%

Scaling Laws for Fine-Grained Mixture of Experts

Jakub Krajewski, Jan Ludziejewski, Kamil Adamczewski, Maciej Pióro, Michał Krutul, Szymon Antoniak, Kamil Ciebiera, Krystian Król, Tomasz Odrzygóźdź, Piotr Sankowski, Marek Cygan, Sebastian Jaszczur

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13545 2024-01-25 cs.IR 75%

Fine-grained Contract NER using instruction based model

Hiranmai Sri Adibhatla, Pavan Baswani, Manish Shrivastava

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07254 2024-01-25 cs.CV cs.CR 75%

Mitigate Replication and Copying in Diffusion Models with Generalized Caption and Dual Fusion Enhancement

Chenghao Li, Dake Chen, Yuke Zhang, Peter A. Beerel

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments This paper has been accepted for presentation at 2024 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10841 2024-01-25 cs.CL cs.AI cs.IR cs.LG 75%

Using LLMs to discover emerging coded antisemitic hate-speech in extremist social media

Dhanush Kikkisetti, Raza Ul Mustafa, Wendy Melillo, Roberto Corizzo, Zois Boukouvalas, Jeff Gill, Nathalie Japkowicz

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, 4 figures, 2 algorithms, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13971 2024-01-19 cs.CL cs.AI cs.LG 75%

Grammar-Constrained Decoding for Structured NLP Tasks without Finetuning

Saibo Geng, Martin Josifoski, Maxime Peyrard, Robert West

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2023 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09092 2024-01-18 cs.IR cs.HC 75%

BibSonomy Meets ChatLLMs for Publication Management: From Chat to Publication Management: Organizing your related work using BibSonomy & LLMs

Tom Völker, Jan Pfister, Tobias Koopmann, Andreas Hotho

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at 2024 ACM SIGIR CHIIR, For a demo see here http://professor-x.de/demos/bibsonomy-chatgpt/demo.mp4

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11671 2024-01-05 cs.CL cs.AI cs.LG 75%

Evaluating Language-Model Agents on Realistic Autonomous Tasks

Megan Kinniment, Lucas Jun Koba Sato, Haoxing Du, Brian Goodrich, Max Hasin, Lawrence Chan, Luke Harold Miles, Tao R. Lin, Hjalmar Wijk, Joel Burget, Aaron Ho, Elizabeth Barnes, Paul Christiano

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13952 2023-09-26 cs.CV cs.AI cs.CL cs.LG 75%

VidChapters-7M: Video Chapters at Scale

Antoine Yang, Arsha Nagrani, Ivan Laptev, Josef Sivic, Cordelia Schmid

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2023 Track on Datasets and Benchmarks; Project Webpage: https://antoyang.github.io/vidchapters.html ; 31 pages; 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03241 2023-09-13 cs.LG cs.AI cs.CL 75%

GPT Can Solve Mathematical Problems Without a Calculator

Zhen Yang, Ming Ding, Qingsong Lv, Zhihuan Jiang, Zehai He, Yuyi Guo, Jinfeng Bai, Jie Tang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 26pages,14figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04781 2023-08-29 cs.CY 75%

Demonstrations of the Potential of AI-based Political Issue Polling

Nathan E. Sanders, Alex Ulinich, Bruce Schneier

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 23 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11827 2023-08-24 cs.CL cs.AI cs.LG 75%

Exploring the Effectiveness of GPT Models in Test-Taking: A Case Study of the Driver's License Knowledge Test

Saba Rahimi, Tucker Balch, Manuela Veloso

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02394 2023-08-08 cs.CL cs.AI cs.CR cs.LG 75%

Defending against Insertion-based Textual Backdoor Attacks via Attribution

Jiazhao Li, Zhuofeng Wu, Wei Ping, Chaowei Xiao, V. G. Vinod Vydiswaran

专题命中 预训练与数据 :language model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Findings of ACL 2023. Camera-ready version

Journal ref Findings of ACL 2023, July 2023, Page 8818-8833, Toronto, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19148 2023-08-07 cs.CL cs.AI cs.LG 75%

Mitigating Label Biases for In-context Learning

Yu Fei, Yifan Hou, Zeming Chen, Antoine Bosselut

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04601 2023-07-11 cs.IR 75%

InPars Toolkit: A Unified and Reproducible Synthetic Data Generation Pipeline for Neural Information Retrieval

Hugo Abonizio, Luiz Bonifacio, Vitor Jeronymo, Roberto Lotufo, Jakub Zavrel, Rodrigo Nogueira

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04637 2023-07-07 cs.LG cs.AI cs.CL math.ST stat.ML stat.TH 75%

Transformers as Statisticians: Provable In-Context Learning with In-Context Algorithm Selection

Yu Bai, Fan Chen, Huan Wang, Caiming Xiong, Song Mei

专题命中 预训练与数据 :pretraining(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments V2 releases code

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08833 2023-06-16 cs.HC 75%

Safeguarding Crowdsourcing Surveys from ChatGPT with Prompt Injection

Chaofan Wang, Samuel Kernan Freire, Mo Zhang, Jing Wei, Jorge Goncalves, Vassilis Kostakos, Zhanna Sarsenbayeva, Christina Schneegass, Alessandro Bozzon, Evangelos Niforatos

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05432 2023-06-12 cs.CL cs.AI cs.LG eess.AS 75%

Towards End-to-end Speech-to-text Summarization

Raul Monteiro, Diogo Pernes

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the 26th International Conference of Text, Speech and Dialogue (TSD2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14293 2023-06-09 cs.CL cs.AI cs.LG 75%

Controlled Text Generation with Natural Language Instructions

Wangchunshu Zhou, Yuchen Eleanor Jiang, Ethan Wilcox, Ryan Cotterell, Mrinmaya Sachan

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01761 2023-06-06 cs.CL cs.AI cs.LG 75%

Distinguishing Human Generated Text From ChatGPT Generated Text Using Machine Learning

Niful Islam, Debopom Sutradhar, Humaira Noor, Jarin Tasnim Raya, Monowara Tabassum Maisha, Dewan Md Farid

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏