arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12403 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2406.16135 2025-03-05 cs.CL cs.LG 90%

Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models

Lynn Chua, Badih Ghazi, Yangsibo Huang, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Amer Sinha, Chulin Xie, Chiyuan Zhang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04556 2025-02-26 cs.CL cs.LG 90%

How Does Code Pretraining Affect Language Model Task Performance?

Jackson Petty, Sjoerd van Steenkiste, Tal Linzen

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Journal ref Transactions on Machine Learning Research (January 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16280 2025-02-25 cs.LG cs.AI 90%

Human Preferences in Large Language Model Latent Space: A Technical Analysis on the Reliability of Synthetic Data in Voting Outcome Prediction

Sarah Ball, Simeon Allmendinger, Frauke Kreuter, Niklas Kühl

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08524 2025-02-13 cs.LG cs.CL 90%

LLM Pretraining with Continuous Concepts

Jihoon Tack, Jack Lanchantin, Jane Yu, Andrew Cohen, Ilia Kulikov, Janice Lan, Shibo Hao, Yuandong Tian, Jason Weston, Xian Li

专题命中 预训练与数据 :pretraining(title,abstract);LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08707 2025-02-13 cs.LG cs.AI 90%

Beam Prediction based on Large Language Models

Yucheng Sheng, Kai Huang, Le Liang, Peng Liu, Shi Jin, Geoffrey Ye Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00059 2025-02-04 cs.LG cs.AI 90%

Large Language Models are Few-shot Multivariate Time Series Classifiers

Yakun Chen, Zihao Li, Chao Yang, Xianzhi Wang, Guandong Xu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19298 2025-02-03 cs.AI cs.LG cs.NI 90%

Synthetic User Behavior Sequence Generation with Large Language Models for Smart Homes

Zhiyao Xu, Dan Zhao, Qingsong Zou, Jingyu Xiao, Yong Jiang, Zhenhui Yuan, Qing Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16241 2025-01-28 cs.LG cs.CL hep-th physics.data-an 90%

Phase Transitions in Large Language Models and the $O(N)$ Model

Youran Sun, Babak Haghighat

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13976 2025-01-27 cs.CL cs.AI cs.CY cs.SI 90%

Towards Safer Social Media Platforms: Scalable and Performant Few-Shot Harmful Content Moderation Using Large Language Models

Akash Bonagiri, Lucen Li, Rajvardhan Oak, Zeerak Babar, Magdalena Wojcieszak, Anshuman Chhabra

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments This paper is in submission and under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18023 2025-01-16 cs.AI cs.CL 90%

Do Large Language Models Mirror Cognitive Language Processing?

Yuqi Ren, Renren Jin, Tongxuan Zhang, Deyi Xiong

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05078 2025-01-10 cs.LG cs.AI 90%

Analyzing Memorization in Large Language Models through the Lens of Model Attribution

Tarun Ram Menta, Susmit Agrawal, Chirag Agarwal

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20357 2024-12-31 cs.CL cs.AI 90%

HindiLLM: Large Language Model for Hindi

Sanjay Chouhan, Shubha Brata Nath, Aparajita Dutta

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Journal ref Pattern Recognition. ICPR 2024. Lecture Notes in Computer Science, vol 15306, pp. 255--270, Springer, Cham, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15431 2024-12-23 cs.LG cs.CL cs.CR 90%

Time Will Tell: Timing Side Channels via Output Token Count in Large Language Models

Tianchen Zhang, Gururaj Saileshwar, David Lie

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19998 2024-12-23 cs.CL cs.AI 90%

Do Influence Functions Work on Large Language Models?

Zhe Li, Wei Zhao, Yige Li, Jun Sun

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10630 2024-11-26 cs.CL cs.LG 90%

HLAT: High-quality Large Language Model Pre-trained on AWS Trainium

Haozheng Fan, Hao Zhou, Guangtai Huang, Parameswaran Raman, Xinwei Fu, Gaurav Gupta, Dhananjay Ram, Yida Wang, Jun Huan

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08262 2024-11-07 cs.CL cs.AI 90%

Pretraining and Updates of Domain-Specific LLM: A Case Study in the Japanese Business Domain

Kosuke Takahashi, Takahiro Omi, Kosuke Arima, Tatsuya Ishigaki

专题命中 预训练与数据 :LLM(title,abstract);pretraining(title);large language model(abstract);language model(abstract)

Comments Accepted at PACLIC 38

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05188 2024-11-05 cs.CR cs.AI cs.CL 90%

Have You Merged My Model? On The Robustness of Large Language Model IP Protection Methods Against Model Merging

Tianshuo Cong, Delong Ran, Zesen Liu, Xinlei He, Jinyuan Liu, Yichen Gong, Qi Li, Anyu Wang, Xiaoyun Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACM CCS-LAMPS 2024 (Best Paper Award)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00801 2024-11-05 cs.IR cs.AI cs.CL 90%

Self-Retrieval: End-to-End Information Retrieval with One Large Language Model

Qiaoyu Tang, Jiawei Chen, Zhuoqun Li, Bowen Yu, Yaojie Lu, Cheng Fu, Haiyang Yu, Hongyu Lin, Fei Huang, Ben He, Xianpei Han, Le Sun, Yongbin Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024 Camera-ready Version. Code: https://github.com/icip-cas/SelfRetrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12670 2024-10-31 cs.AI cs.LG 90%

Stealth edits to large language models

Oliver J. Sutton, Qinghua Zhou, Wei Wang, Desmond J. Higham, Alexander N. Gorban, Alexander Bastounis, Ivan Y. Tyukin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 28 pages, 14 figures. Open source implementation: https://github.com/qinghua-zhou/stealth-edits

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21717 2024-10-30 cs.LG cs.AI 90%

Generating Realistic Tabular Data with Large Language Models

Dang Nguyen, Sunil Gupta, Kien Do, Thin Nguyen, Svetha Venkatesh

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments To appear at ICDM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11724 2024-10-24 cs.CL cs.AI cs.CR cs.IR 90%

Token-wise Influential Training Data Retrieval for Large Language Models

Huawei Lin, Jikai Long, Zhaozhuo Xu, Weijie Zhao

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024. Keywords: Influence Function, Influence Estimation, Training Data Attribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15966 2024-10-22 cs.CL cs.AI cs.SE 90%

Self-Explained Keywords Empower Large Language Models for Code Generation

Lishui Fan, Mouxiang Chen, Zhongxin Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11244 2024-10-21 cs.CL cs.LG 90%

Entity Matching using Large Language Models

Ralph Peeters, Aaron Steiner, Christian Bizer

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Published in Proceedings of the 28th International Conference on Extending Database Technology (EDBT), 25th March-28th March, 2025, ISBN 978-3-89318-098-1 on OpenProceedings.org

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12989 2024-10-18 cs.CL cs.AI 90%

Qtok: A Comprehensive Framework for Evaluating Multilingual Tokenizer Quality in Large Language Models

Iaroslav Chelombitko, Egor Safronov, Aleksey Komissarov

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 9 figures, 6 tables. Code and data available at https://github.com/nup-csai/Qtok/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11550 2024-10-16 cs.AI cs.CL 90%

Y-Mol: A Multiscale Biomedical Knowledge-Guided Large Language Model for Drug Development

Tengfei Ma, Xuan Lin, Tianle Li, Chaoyi Li, Long Chen, Peng Zhou, Xibao Cai, Xinyu Yang, Daojian Zeng, Dongsheng Cao, Xiangxiang Zeng

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 12 pages, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07951 2024-10-11 cs.CL cs.LG 90%

Disease Entity Recognition and Normalization is Improved with Large Language Model Derived Synthetic Normalized Mentions

Kuleen Sasse, Shinjitha Vadlakonda, Richard E. Kennedy, John D. Osborne

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 21 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11050 2024-10-07 cs.CL cs.AI 90%

A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners

Bowen Jiang, Yangxinyu Xie, Zhuoqun Hao, Xiaomeng Wang, Tanwi Mallick, Weijie J. Su, Camillo J. Taylor, Dan Roth

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00646 2024-09-26 cs.LG cs.AI stat.ML 90%

Source Attribution for Large Language Model-Generated Data

Jingtan Wang, Xinyang Lu, Zitong Zhao, Zhongxiang Dai, Chuan-Sheng Foo, See-Kiong Ng, Bryan Kian Hsiang Low

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13935 2024-09-25 cs.CL cs.AI cs.CY 90%

MirrorStories: Reflecting Diversity through Personalized Narrative Generation with Large Language Models

Sarfaroz Yunusov, Hamza Sidat, Ali Emami

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 5 pages (excluding references), accepted to EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09895 2024-09-16 cs.CL cs.LG 90%

Performance Law of Large Language Models

Chuhan Wu, Ruiming Tang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Personal opinions of the authors

详情

展开后加载摘要…

URL PDF HTML 收藏