arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12403 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2503.00084 2025-03-04 cs.SD cs.AI cs.CL eess.AS 88%

InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation

Chong Zhang, Yukun Ma, Qian Chen, Wen Wang, Shengkui Zhao, Zexu Pan, Hao Wang, Chongjia Ni, Trung Hieu Nguyen, Kun Zhou, Yidi Jiang, Chaohong Tan, Zhifu Gao, Zhihao Du, Bin Ma

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Work in progress. Correspondence regarding this technical report should be directed to {chong.zhang, yukun.ma}@alibaba-inc.com. Online demo available on https://modelscope.cn/studios/iic/InspireMusic and https://huggingface.co/spaces/FunAudioLLM/InspireMusic

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18505 2025-02-27 cs.SE cs.AI cs.CL 88%

Comprehensive Analysis of Transparency and Accessibility of ChatGPT, DeepSeek, And other SoTA Large Language Models

Ranjan Sapkota, Shaina Raza, Manoj Karkee

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05893 2025-02-24 cs.AI cs.CL cs.IR 88%

Use of a Structured Knowledge Base Enhances Metadata Curation by Large Language Models

Sowmya S. Sundaram, Benjamin Solomon, Avani Khatri, Anisha Laumas, Purvesh Khatri, Mark A. Musen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02370 2025-02-17 cs.CL cs.AI 88%

Do Large Language Models Possess Sensitive to Sentiment?

Yang Liu, Xichou Zhu, Zhou Shen, Yi Liu, Min Li, Yujun Chen, Benzi John, Zhenzhen Ma, Tao Hu, Zhi Li, Zhiyang Xu, Wei Luo, Junhui Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08441 2025-02-14 cs.CL cs.AI 88%

Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation

Riccardo Cantini, Giada Cosenza, Alessio Orsino, Domenico Talia

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02936 2025-02-13 cs.CL cs.LG 88%

Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models

Jingyang Zhang, Jingwei Sun, Eric Yeats, Yang Ouyang, Martin Kuo, Jianyi Zhang, Hao Frank Yang, Hai Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments ICLR'25 Spotlight. Project page and code is available at https://zjysteven.github.io/mink-plus-plus/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05248 2025-02-11 cs.CL cs.AI cs.MA 88%

Evaluating Personality Traits in Large Language Models: Insights from Psychological Questionnaires

Pranav Bhandari, Usman Naseem, Amitava Datta, Nicolas Fay, Mehwish Nasim

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at TheWebConf 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06663 2025-02-10 cs.CR cs.CL cs.LG 88%

SecureNet: A Comparative Study of DeBERTa and Large Language Models for Phishing Detection

Sakshi Mahendru, Tejul Pandit

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Preprint. 10 pages, Accepted in IEEE 7th International Conference on Big Data and Artificial Intelligence (BDAI 2024)

Journal ref 2024 IEEE 7th International Conference on Big Data and Artificial Intelligence (BDAI), Beijing, China, 2024, pp. 160-169

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03429 2025-02-06 cs.CL cs.AI 88%

On Fairness of Unified Multimodal Large Language Model for Image Generation

Ming Liu, Hao Chen, Jindong Wang, Liwen Wang, Bhiksha Raj Ramakrishnan, Wensheng Zhang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13720 2025-02-04 cs.CL cs.AI cs.SD eess.AS 88%

Musical ethnocentrism in Large Language Models

Anna Kruspe

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the 3rd Workshop on NLP for Music and Audio (NLP4MusA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15287 2025-01-30 cs.CL cs.AI 88%

Sycophancy in Large Language Models: Causes and Mitigations

Lars Malmqvist

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref Computing Conference 2025 (upcoming)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16247 2025-01-28 cs.LG cs.CL 88%

Zero-Shot Decision Tree Construction via Large Language Models

Lucas Carrasco, Felipe Urrutia, Andrés Abeliuk

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14818 2025-01-28 cs.CV cs.AI cs.LG 88%

Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models

Zhiqi Li, Guo Chen, Shilong Liu, Shihao Wang, Vibashan VS, Yishen Ji, Shiyi Lan, Hao Zhang, Yilin Zhao, Subhashree Radhakrishnan, Nadine Chang, Karan Sapra, Amala Sanjay Deshmukh, Tuomas Rintamaki, Matthieu Le, Ilia Karmanov, Lukas Voegtle, Philipp Fischer, De-An Huang, Timo Roman, Tong Lu, Jose M. Alvarez, Bryan Catanzaro, Jan Kautz, Andrew Tao, Guilin Liu, Zhiding Yu

专题命中 预训练与数据 :language model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11747 2025-01-27 cs.CL cs.AI 88%

Optimizing Pretraining Data Mixtures with LLM-Estimated Utility

William Held, Bhargavi Paranjape, Punit Singh Koura, Mike Lewis, Frank Zhang, Todor Mihaylov

专题命中 预训练与数据 :LLM(title);pretraining(title);large language model(abstract);language model(abstract)

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14670 2024-12-20 cs.CL cs.AI 88%

Analysis and Visualization of Linguistic Structures in Large Language Models: Neural Representations of Verb-Particle Constructions in BERT

Hassane Kissane, Achim Schilling, Patrick Krauss

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07144 2024-12-16 cs.AI cs.CL 88%

Political Actor Agent: Simulating Legislative System for Roll Call Votes Prediction with Large Language Models

Hao Li, Ruoyuan Gong, Hao Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08846 2024-12-13 cs.CL cs.AI 88%

Exploring Large Language Models on Cross-Cultural Values in Connection with Training Methodology

Minsang Kim, Seungjun Baek

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15861 2024-12-11 cs.CL cs.AI 88%

BPDec: Unveiling the Potential of Masked Language Modeling Decoder in BERT pretraining

Wen Liang, Youzhi Liang

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12240 2024-11-27 cs.CL cs.AI 88%

Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages

S. Tamang, D. J. Bora

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11793 2024-11-26 cs.CL cs.AI cs.ET cs.SC 88%

Reasoning Abilities of Large Language Models: In-Depth Analysis on the Abstraction and Reasoning Corpus

Seungpil Lee, Woochang Sim, Donghyeon Shin, Wongyu Seo, Jiwon Park, Seokki Lee, Sanha Hwang, Sejin Kim, Sundong Kim

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06402 2024-11-12 cs.CL cs.AI 88%

Fineweb-Edu-Ar: Machine-translated Corpus to Support Arabic Small Language Models

Sultan Alrashed, Dmitrii Khizbullin, David R. Pugh

专题命中 预训练与数据 :language model(title,abstract);small language model(title);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16148 2024-11-08 cs.SD cs.AI cs.LG eess.AS 88%

Towards Open Respiratory Acoustic Foundation Models: Pretraining and Benchmarking

Yuwei Zhang, Tong Xia, Jing Han, Yu Wu, Georgios Rizos, Yang Liu, Mohammed Mosuily, Jagmohan Chauhan, Cecilia Mascolo

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(title,abstract);分类 cs.AI、cs.LG

Comments accepted by NeurIPS 2024 Track Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03340 2024-11-07 cs.CV cs.CL cs.DL cs.LG 88%

Unlocking the Archives: Using Large Language Models to Transcribe Handwritten Historical Documents

Mark Humphries, Lianne C. Leddy, Quinn Downton, Meredith Legace, John McConnell, Isabella Murray, Elizabeth Spence

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 29 Pages, 11 Tables, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20340 2024-10-29 cs.CL cs.AI 88%

Maintaining Informative Coherence: Migrating Hallucinations in Large Language Models via Absorbing Markov Chains

Jiemin Wu, Songning Lai, Ruiqiang Xiao, Tianlang Xue, Jiayu Yang, Yutao Yue

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13298 2024-10-18 cs.CL cs.AI 88%

Advancing Large Language Model Attribution through Self-Improving

Lei Huang, Xiaocheng Feng, Weitao Ma, Liang Zhao, Yuchun Fan, Weihong Zhong, Dongliang Xu, Qing Yang, Hongtao Liu, Bing Qin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05661 2024-10-10 cs.LG cs.AI 88%

Scaling Laws Across Model Architectures: A Comparative Analysis of Dense and MoE Models in Large Language Models

Siqi Wang, Zhengyu Chen, Bei Li, Keqing He, Min Zhang, Jingang Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03568 2024-10-07 cs.CL cs.LG 88%

Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)

Abrar Rahman, Garry Bowlin, Binit Mohanty, Sean McGunigal

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.02458 2024-08-27 cs.CL cs.LG 88%

Topics as Entity Clusters: Entity-based Topics from Large Language Models and Graph Neural Networks

Manuel V. Loureiro, Steven Derby, Tri Kurniawan Wijaya

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 16 pages, 1 figure. Accepted in LREC-COLING 2024

Journal ref https://aclanthology.org/2024.lrec-main.1418/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10892 2024-08-20 cs.CR cs.CL cs.LG 88%

Proving membership in LLM pretraining data via data watermarks

Johnny Tian-Zheng Wei, Ryan Yixiang Wang, Robin Jia

专题命中 预训练与数据 :LLM(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.LG

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07032 2024-08-13 cs.CL cs.AI 88%

ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook

Wangtao Sun, Xuanqing Yu, Shizhu He, Jun Zhao, Kang Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 findings

详情

展开后加载摘要…

URL PDF HTML 收藏