arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12403 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2402.12150 2024-02-20 cs.CL cs.AI 90%

Your Large Language Model is Secretly a Fairness Proponent and You Should Prompt it Like One

Tianlin Li, Xiaoyu Zhang, Chao Du, Tianyu Pang, Qian Liu, Qing Guo, Chao Shen, Yang Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11489 2024-01-31 cs.CL cs.AI 90%

Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling

Linyao Yang, Hongyang Chen, Zhao Li, Xiao Ding, Xindong Wu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08089 2024-01-17 cs.CL cs.AI cs.RO 90%

A Study on Training and Developing Large Language Models for Behavior Tree Generation

Fu Li, Xueying Wang, Bin Li, Yunlong Wu, Yanzhen Wang, Xiaodong Yi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00676 2024-01-02 cs.CR cs.CL cs.LG 90%

Digger: Detecting Copyright Content Mis-usage in Large Language Model Training

Haodong Li, Gelei Deng, Yi Liu, Kailong Wang, Yuekang Li, Tianwei Zhang, Yang Liu, Guoai Xu, Guosheng Xu, Haoyu Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08628 2023-12-15 cs.CL cs.CR cs.LG 90%

Recovering from Privacy-Preserving Masking with Large Language Models

Arpita Vats, Zhe Liu, Peng Su, Debjyoti Paul, Yingyi Ma, Yutong Pang, Zeeshan Ahmed, Ozlem Kalinli

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted to ICASSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19671 2023-11-01 cs.CL cs.AI 90%

Large Language Models: The Need for Nuance in Current Debates and a Pragmatic Perspective on Understanding

Bram M. A. van Dijk, Tom Kouwenhoven, Marco R. Spruit, Max J. van Duijn

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 0 figures, Forthcoming in Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19596 2023-11-01 cs.CL cs.AI 90%

LLMaAA: Making Large Language Models as Active Annotators

Ruoyu Zhang, Yanzeng Li, Yongliang Ma, Ming Zhou, Lei Zou

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Findings of EMNLP 2023 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18362 2023-10-31 cs.CL cs.CR cs.LG 90%

SoK: Memorization in General-Purpose Large Language Models

Valentin Hartmann, Anshuman Suri, Vincent Bindschaedler, David Evans, Shruti Tople, Robert West

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04721 2023-10-27 cs.AI cs.CL cs.RO 90%

Large Language Models as General Pattern Machines

Suvir Mirchandani, Fei Xia, Pete Florence, Brian Ichter, Danny Driess, Montserrat Gonzalez Arenas, Kanishka Rao, Dorsa Sadigh, Andy Zeng

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 25 figures. To appear at Conference on Robot Learning (CoRL) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11318 2023-10-18 cs.CL cs.AI 90%

Utilising a Large Language Model to Annotate Subject Metadata: A Case Study in an Australian National Research Data Catalogue

Shiwei Zhang, Mingfang Wu, Xiuzhen Zhang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07849 2023-10-16 cs.CL cs.AI 90%

Synthetic Data Generation with Large Language Models for Text Classification: Potential and Limitations

Zhuoyan Li, Hangxiao Zhu, Zhuoran Lu, Ming Yin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06450 2023-10-12 cs.CL cs.AI 90%

Constructive Large Language Models Alignment with Diverse Feedback

Tianshu Yu, Ting-En Lin, Yuchuan Wu, Min Yang, Fei Huang, Yongbin Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00789 2023-10-03 cs.CL cs.LG 90%

Testing the Limits of Unified Sequence to Sequence LLM Pretraining on Diverse Table Data Tasks

Soumajyoti Sarkar, Leonard Lausen

专题命中 预训练与数据 :pretraining(title,abstract);LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10707 2023-09-20 eess.AS cs.CL cs.LG cs.SD 90%

Corpus Synthesis for Zero-shot ASR domain Adaptation using Large Language Models

Hsuan Su, Ting-Yao Hu, Hema Swetha Koppula, Raviteja Vemulapalli, Jen-Hao Rick Chang, Karren Yang, Gautam Varma Mantena, Oncel Tuzel

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14242 2023-08-29 cs.AI cs.CL 90%

The Cultural Psychology of Large Language Models: Is ChatGPT a Holistic or Analytic Thinker?

Chuanyang Jin, Songyang Zhang, Tianmin Shu, Zhihan Cui

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10502 2023-08-22 cs.LG cs.CL stat.ML 90%

GradientCoin: A Peer-to-Peer Decentralized Large Language Models

Yeqi Gao, Zhao Song, Junze Yin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15766 2023-06-29 cs.CL cs.LG 90%

Large Language Models as Annotators: Enhancing Generalization of NLP Models at Minimal Cost

Parikshit Bansal, Amit Sharma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.12925 2023-06-23 cs.CL cs.AI cs.SD eess.AS stat.ML 90%

AudioPaLM: A Large Language Model That Can Speak and Listen

Paul K. Rubenstein, Chulayuth Asawaroengchai, Duc Dung Nguyen, Ankur Bapna, Zalán Borsos, Félix de Chaumont Quitry, Peter Chen, Dalia El Badawy, Wei Han, Eugene Kharitonov, Hannah Muckenhirn, Dirk Padfield, James Qin, Danny Rozenberg, Tara Sainath, Johan Schalkwyk, Matt Sharifi, Michelle Tadmor Ramanovich, Marco Tagliasacchi, Alexandru Tudor, Mihajlo Velimirović, Damien Vincent, Jiahui Yu, Yongqiang Wang, Vicky Zayats, Neil Zeghidour, Yu Zhang, Zhishuai Zhang, Lukas Zilka, Christian Frank

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07922 2023-05-23 cs.CL cs.LG cs.PL 90%

CodeT5+: Open Code Large Language Models for Code Understanding and Generation

Yue Wang, Hung Le, Akhilesh Deepak Gotmare, Nghi D. Q. Bui, Junnan Li, Steven C. H. Hoi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments 26 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07388 2023-02-16 cs.CL cs.AI 90%

Adding Instructions during Pretraining: Effective Way of Controlling Toxicity in Language Models

Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This paper will be presented at EACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.10063 2023-01-26 cs.CL cs.AI 90%

Generate rather than Retrieve: Large Language Models are Strong Context Generators

Wenhao Yu, Dan Iter, Shuohang Wang, Yichong Xu, Mingxuan Ju, Soumya Sanyal, Chenguang Zhu, Michael Zeng, Meng Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted at ICLR 2023 (v3, add code and implementation details)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.15003 2022-10-03 cs.CL cs.AI 90%

Compositional Semantic Parsing with Large Language Models

Andrew Drozdov, Nathanael Schärli, Ekin Akyürek, Nathan Scales, Xinying Song, Xinyun Chen, Olivier Bousquet, Denny Zhou

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Fixed metadata. No other changes

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.13621 2022-09-12 cs.CL cs.LG 90%

Differentially Private Decoding in Large Language Models

Jimit Majmudar, Christophe Dupuy, Charith Peris, Sami Smaili, Rahul Gupta, Richard Zemel

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12600 2022-05-26 cs.CL cs.LG 90%

ORCA: Interpreting Prompted Language Models via Locating Supporting Data Evidence in the Ocean of Pretraining Data

Xiaochuang Han, Yulia Tsvetkov

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.06955 2021-07-16 cs.CL cs.LG 90%

HTLM: Hyper-Text Pre-Training and Prompting of Language Models

Armen Aghajanyan, Dmytro Okhonko, Mike Lewis, Mandar Joshi, Hu Xu, Gargi Ghosh, Luke Zettlemoyer

专题命中 预训练与数据 :language model(title,abstract);prompting(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.02000 2020-02-07 cs.CL cs.LG 90%

Aligning the Pretraining and Finetuning Objectives of Language Models

Nuo Wang Pierse, Jingwen Lu

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);small language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages, 2 figures and 6 tables. Submitted to ICML 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13396 2025-07-08 cs.CL eess.AS 90%

Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR

Yizhou Peng, Hexin Liu, Eng Siong Chng

机构 * Alibaba-NTU Global e-Sustainability CorpLab(阿里巴巴-国立科技大学全球可持续发展公司实验室) Nanyang Technological University(国立科技大学) College of Computing and Data Science(计算与数据科学学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);SLM(abstract,comments);分类 cs.CL

Comments Accepted By Interspeech 2025 MLC-SLM workshop as a Research Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12150 2025-06-17 cs.CL 90%

Idiosyncrasies in Large Language Models

Mingjie Sun, Yida Yin, Zhiqiu Xu, J. Zico Kolter, Zhuang Liu

机构 * Carnegie Mellon University(卡内基梅隆大学) Princeton University(普林斯顿大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.CL

Comments Published in ICML 2025. Website at https://eric-mingjie.github.io/llm-idiosyncrasies/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13545 2026-08-14 cs.CL cs.AI cs.LG 新提交 89%

LittleLearner: Language Models Under Pedagogically Controlled Knowledge Exposure

LittleLearner:受教学可控知识暴露约束的语言模型

Fanfei Li, Jana Zeller, Manuel Prada-Corral, Thaddäus Wiedemer, Prasanna Mayilvahanan, Ryan Cotterell, Wieland Brendel

机构 * Ellis Institute(埃利斯研究所)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract,abstract_cn);pretraining(abstract);post-training(abstract)

AI总结 本研究推出专为美国小学定制的LITTLECURRICULUM语料库,训练得到受知识边界约束的LittleLearner模型,构建沙盒用于研究模型知识习得,实验证实其注入新知识后不会提升超范围能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12741 2026-08-14 cs.IR 新提交 89%

Knowledge Synthesis Review Framework: Task-Level Benchmarking of LLM-Based Systems for Multi-Source Evidence Synthesis

知识综合评审框架:面向多源证据综合的基于大语言模型系统的任务级基准测试

Wafa Shafqat, Mark Patterson, Steven N. Liss

专题命中 预训练与数据 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究提出KSR人机协作框架,将证据综合拆分为4项任务,对4款LLM系统开展任务级基准测试,发现各系统各有优劣,该框架可揭示单源综合遗漏的信息,且透明可审计。

详情

展开后加载摘要…

URL PDF HTML 收藏