arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2501.17202 2025-03-13 cs.SD cs.CL eess.AS 89%

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Chen Chen, Yuchen Hu, Siyin Wang, Helin Wang, Zhehuai Chen, Chao Zhang, Chao-Han Huck Yang, Eng Siong Chng

机构 * Nanyang Technological University(南洋理工大学) NVIDIA(英伟达) Tsinghua University(清华大学) Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07493 2025-03-11 cs.CV cs.AI 89%

V2Flow: Unifying Visual Tokenization and Large Language Model Vocabularies for Autoregressive Image Generation

Guiwei Zhang, Tianyu Zhang, Mohan Zhou, Yalong Bai, Biye Li

机构 * Du Xiaoman Financial(度小满金融)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01659 2025-03-04 cs.CL 89%

Detecting Stylistic Fingerprints of Large Language Models

Yehonatan Bitton, Elad Bitton, Shai Nisan

机构 * Copyleaks

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07298 2025-03-04 cs.CL 89%

The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model

Jiawei Chen, Wentao Chen, Jing Su, Jingjing Xu, Hongyu Lin, Mengjie Ren, Yaojie Lu, Xianpei Han, Le Sun

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) ByteDance Inc(字节跳动公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16790 2025-02-25 cs.CL 89%

Are Large Language Models Good Data Preprocessors?

Elyas Meguellati, Nardiena Pratama, Shazia Sadiq, Gianluca Demartini

机构 * The University of Queensland(昆士兰大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02481 2025-02-25 cs.CL 89%

Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study

Menglong Cui, Pengzhi Gao, Wei Liu, Jian Luan, Bin Wang

机构 * Xiaomi Inc.(小米公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accept to NAACL2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09817 2025-02-25 cs.CL 89%

Reverse Modeling in Large Language Models

Sicheng Yu, Yuanchen Xu, Cunxiao Du, Yanying Zhou, Minghui Qiu, Qianru Sun, Hao Zhang, Jiawei Wu

机构 * Singapore Management University(新加坡管理大学) National University of Singapore(新加坡国立大学) Fudan University(复旦大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments NAACL 2025 Camera-ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13252 2025-02-20 cs.CL 89%

Multilingual Language Model Pretraining using Machine-translated Data

Jiayi Wang, Yao Lu, Maurice Weber, Max Ryabinin, David Adelani, Yihong Chen, Raphael Tang, Pontus Stenetorp

机构 * Centre for Artificial Intelligence, University College London(伦敦大学学院人工智能中心) Together AI Mila, McGill University(米拉-麦吉尔大学) Research and Development Center for Large Language Models, National Institute of Informatics(国立信息学研究所大语言模型研发中心)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16524 2025-01-29 cs.CL 89%

Programming by Examples Meets Historical Linguistics: A Large Language Model Based Approach to Sound Law Induction

Atharva Naik, Darsh Agrawal, Hong Sng, Clayton Marr, Kexun Zhang, Nathaniel R Robinson, Kalvin Chang, Rebecca Byrnes, Aravind Mysore, Carolyn Rose, David R Mortensen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08769 2025-01-28 cs.CL 89%

Enhanced Large Language Models for Effective Screening of Depression and Anxiety

June M. Liu, Mengxia Gao, Sahand Sabour, Zhuang Chen, Minlie Huang, Tatia M. C. Lee

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20641 2024-12-31 cs.LG cs.CR 89%

SafeSynthDP: Leveraging Large Language Models for Privacy-Preserving Synthetic Data Generation Using Differential Privacy

Md Mahadi Hasan Nahid, Sadid Bin Hasan

机构 * University of Alberta(阿尔伯塔大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 15 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18626 2024-12-30 cs.CL 89%

Why Do Large Language Models (LLMs) Struggle to Count Letters?

Tairan Fu, Raquel Ferrando, Javier Conde, Carlos Arriaga, Pedro Reviriego

机构 * College of Mechanical & Electrical Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学机电学院) ETSI de Telecomunicación, Universidad Politécnica de Madrid(马德里理工大学电信高级工程学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12956 2024-12-18 cs.CL 89%

SnakModel: Lessons Learned from Training an Open Danish Large Language Model

Mike Zhang, Max Müller-Eberstein, Elisa Bassignana, Rob van der Goot

机构 * Aalborg University(奥尔堡大学) IT University of Copenhagen(哥本哈根信息技术大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at NoDaLiDa 2025 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16044 2024-12-18 cs.AI 89%

LLMLight: Large Language Models as Traffic Signal Control Agents

Siqi Lai, Zhao Xu, Weijia Zhang, Hao Liu, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12435 2024-12-16 cs.CL 89%

Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models

Xinyu Zhou, Delong Chen, Samuel Cahyawijaya, Xufeng Duan, Zhenguang G. Cai

机构 * Université Paris Cité(巴黎西岱大学) Sorbonne Université(索邦大学) CUHK(香港中文大学) HKUST(香港科技大学) Cohere Brain and Mind Institute, CUHK(香港中文大学脑与心智研究所)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05185 2024-12-12 cs.CV cs.LG cs.MM 89%

LinVT: Empower Your Image-level Large Language Model to Understand Videos

Lishuai Gao, Yujie Zhong, Yingsen Zeng, Haoxian Tan, Dengjie Li, Zheng Zhao

机构 * Meituan Inc.(美团公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11248 2024-11-28 eess.AS cs.AI cs.SD 89%

Performance Improvement of Language-Queried Audio Source Separation Based on Caption Augmentation From Large Language Models for DCASE Challenge 2024 Task 9

Do Hyun Lee, Yoonah Song, Hong Kook Kim

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments DCASE 2024 Challenge Task 9, 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14513 2024-11-25 cs.SE cs.CL 89%

Towards a Middleware for Large Language Models

Narcisa Guran, Florian Knauf, Man Ngo, Stefan Petrescu, Jan S. Rellermeyer

机构 * Leibniz University Hannover(汉诺威莱布尼茨大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04448 2024-11-08 cs.CL 89%

Gradient Localization Improves Lifelong Pretraining of Language Models

Jared Fernandez, Yonatan Bisk, Emma Strubell

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);large language model(abstract);分类 cs.CL

Comments EMNLP Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09180 2024-11-06 cs.CL cs.HC cs.IR 89%

Pearl: Personalizing Large Language Model Writing Assistants with Generation-Calibrated Retrievers

Sheshera Mysore, Zhuoran Lu, Mengting Wan, Longqi Yang, Bahareh Sarrafzadeh, Steve Menezes, Tina Baghaee, Emmanuel Barajas Gonzalez, Jennifer Neville, Tara Safavi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to Workshop on Customizable NLP at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15226 2024-10-24 cs.CL 89%

On the Diversity of Synthetic Data and its Impact on Training Large Language Models

Hao Chen, Abdul Waheed, Xiang Li, Yidong Wang, Jindong Wang, Bhiksha Raj, Marah I. Abdin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17152 2024-10-23 cs.IR cs.CL 89%

Improving Pinterest Search Relevance Using Large Language Models

Han Wang, Mukuntha Narayanan Sundararaman, Onur Gungor, Yu Xu, Krishna Kamath, Rakesh Chalasani, Kurchi Subhra Hazra, Jinfeng Rao

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments CIKM 2024 Workshop on Industrial Recommendation Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11075 2024-10-11 cs.CL 89%

Split and Rephrase with Large Language Models

David Ponce, Thierry Etchegoyhen, Jesús Calleja Pérez, Harritxu Gete

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04784 2024-10-08 cs.CL 89%

Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge

Jiahuan Li, Yiqing Cao, Shujian Huang, Jiajun Chen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments accepted by EMNLP 2024, main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09812 2024-10-08 cs.CL 89%

Large Language Models for Propaganda Span Annotation

Maram Hasanain, Fatema Ahmad, Firoj Alam

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments propaganda, span detection, disinformation, misinformation, fake news, LLMs, GPT-4

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04197 2024-10-08 cs.CL 89%

CS4: Measuring the Creativity of Large Language Models Automatically by Controlling the Number of Story-Writing Constraints

Anirudh Atmakuru, Jatin Nainani, Rohith Siddhartha Reddy Bheemreddy, Anirudh Lakkaraju, Zonghai Yao, Hamed Zamani, Haw-Shiuan Chang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04103 2024-10-08 cs.CL 89%

A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models

Zhihao Wang, Shiyu Liu, Jianheng Huang, Zheng Wang, Yixuan Liao, Xiaoxin Chen, Junfeng Yao, Jinsong Su

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2024 (main,long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05417 2024-09-30 cs.CL 89%

Fishing for Magikarp: Automatically Detecting Under-trained Tokens in Large Language Models

Sander Land, Max Bartolo

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 16 pages, 6 figures. Accepted at EMNLP 2024, main track. For associated code, see https://github.com/cohere-ai/magikarp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16807 2024-09-30 cs.CL 89%

Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning

Tianhui Zhang, Bei Peng, Danushka Bollegala

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2024 Findings, Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16332 2024-09-26 cs.IR cs.CL 89%

DemoRank: Selecting Effective Demonstrations for Large Language Models in Ranking Task

Wenhan Liu, Yutao Zhu, Zhicheng Dou

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏