arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2501.11441 2025-03-28 cs.IR cs.CL 90%

Ontology Matching with Large Language Models and Prioritized Depth-First Search

Maria Taboada, Diego Martinez, Mohammed Arideh, Rosa Mosquera

机构 * University of Santiago de Compostela(圣地亚哥德孔波斯特拉大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15924 2025-02-25 cs.CL 90%

Improving Consistency in Large Language Models through Chain of Guidance

Harsh Raj, Vipul Gupta, Domenic Rosati, Subhabrata Majumdar

机构 * Northeastern University(东北大学) Pennsylvania State University(宾夕法尼亚州立大学) Dalhousie University(达尔豪斯大学) Vijil(维吉尔科技)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at Transactions of Machine Learning Research (TMLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00498 2025-02-04 cs.AI physics.comp-ph 90%

MetaOpenFOAM 2.0: Large Language Model Driven Chain of Thought for Automating CFD Simulation and Post-Processing

Yuxuan Chen, Xu Zhu, Hua Zhou, Zhuyin Ren

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments 16 pages,11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00329 2025-02-04 cs.DB cs.AI 90%

CoddLLM: Empowering Large Language Models for Data Analytics

Jiani Zhang, Hengrui Zhang, Rishav Chakravarti, Yiqun Hu, Patrick Ng, Asterios Katsifodimos, Huzefa Rangwala, George Karypis, Alon Halevy

机构 * Amazon Web Services(亚马逊网络服务) University of Illinois, Chicago(伊利诺伊大学芝加哥分校) TU Delft(代尔夫特理工大学) Google(谷歌)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09560 2025-01-29 cond-mat.mtrl-sci cs.CL cs.IR 90%

Foundational Large Language Models for Materials Research

Vaibhav Mishra, Somaditya Singh, Dhruv Ahlawat, Mohd Zaki, Vaibhav Bihani, Hargun Singh Grover, Biswajit Mishra, Santiago Miret, Mausam, N. M. Anoop Krishnan

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04809 2025-01-28 cs.CL 90%

Low-Resource Machine Translation through Retrieval-Augmented LLM Prompting: A Study on the Mambai Language

Raphaël Merx, Aso Mahmudi, Katrina Langford, Leo Alberto de Araujo, Ekaterina Vylomova

机构 * Catalpa International(卡特帕国际) The University of Melbourne(墨尔本大学) Timorlink(帝汶链接) Seminario Menor Balide Dili(帝力巴利德神学院)

专题命中 预训练与数据 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04455 2025-01-09 cs.CL cs.DL 90%

Hidden Entity Detection from GitHub Leveraging Large Language Models

Lu Gan, Martin Blum, Danilo Dessi, Brigitte Mathiak, Ralf Schenkel, Stefan Dietze

机构 * GESIS – Leibniz Institute for the Social Sciences(GESIS——莱布尼茨社会科学研究所) Heinrich Heine University Düsseldorf(杜塞尔多夫海因里希·海涅大学) University of Trier(特里尔大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments accepted by KDD2024 workshop DL4KG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05706 2024-12-02 cs.CL cs.SD eess.AS 90%

Paralinguistics-Aware Speech-Empowered Large Language Models for Natural Conversation

Heeseung Kim, Soonshin Seo, Kyeongseok Jeong, Ohsung Kwon, Soyoon Kim, Jungwhan Kim, Jaehong Lee, Eunwoo Song, Myungwoo Oh, Jung-Woo Ha, Sungroh Yoon, Kang Min Yoo

机构 * Seoul National University(首尔大学) NAVER Cloud(NAVER云) Artificial Intelligence Institute, Seoul National University(首尔大学人工智能研究院) NAVER AI Lab(NAVER人工智能实验室)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments NeurIPS 2024, Project Page: https://unifiedsdm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10813 2024-11-19 cs.CL 90%

Information Anxiety in Large Language Models

Prasoon Bajpai, Sarah Masud, Tanmoy Chakraborty

机构 * Indian Institute of Technology, Delhi(印度理工学院德里分校) University of Copenhagen(哥本哈根大学) Yardi School of Artificial Intelligence, Indian Institute of Technology, Delhi(印度理工学院德里分校亚尔迪人工智能学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10839 2024-11-13 cs.CV cs.CL 90%

Reminding Multimodal Large Language Models of Object-aware Knowledge with Retrieved Tags

Daiqing Qi, Handong Zhao, Zijun Wei, Sheng Li

机构 * University of Virginia(弗吉尼亚大学) Adobe Research(奥多比研究院) Adobe Inc.(奥多比公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);instruction tuning(abstract)

Comments Main Conference at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11142 2024-10-28 cs.CL 90%

Grasping the Essentials: Tailoring Large Language Models for Zero-Shot Relation Extraction

Sizhe Zhou, Yu Meng, Bowen Jin, Jiawei Han

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);small language model(abstract);SLM(abstract)

Comments 25 pages, 20 Tables, 9 Figures; Accepted to EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00921 2024-10-14 cs.PL cs.AI cs.SE 90%

Statically Contextualizing Large Language Models with Typed Holes

Andrew Blinn, Xiang Li, June Hyung Kim, Cyrus Omar

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments To appear at OOPSLA2024

Journal ref Proceedings of the ACM on Programming Languages, Volume 8, 2024; Issue OOPSLA2 Article No.: 288, Pages 468 - 498

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00341 2024-10-01 cs.CL 90%

Iterative Data Generation with Large Language Models for Aspect-based Sentiment Analysis

Qihuang Zhong, Haiyun Li, Luyao Zhuang, Juhua Liu, Bo Du

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11294 2024-08-22 cs.CL 90%

RedWhale: An Adapted Korean LLM Through Efficient Continual Pretraining

Anh-Dung Vo, Minseong Jung, Wonbeen Lee, Daewoo Choi

专题命中 预训练与数据 :LLM(title,abstract);pretraining(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01380 2024-08-05 cs.CL 90%

Coalitions of Large Language Models Increase the Robustness of AI Agents

Prattyush Mangal, Carol Mak, Theo Kanakis, Timothy Donovan, Dave Braines, Edward Pyzer-Knapp

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13231 2024-07-09 cs.CL cs.CY 90%

Investigating Cultural Alignment of Large Language Models

Badr AlKhamissi, Muhammad ElNokrashy, Mai AlKhamissi, Mona Diab

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

Comments ACL 2024 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02770 2024-07-04 cs.LG cs.CE 90%

Large language models, physics-based modeling, experimental measurements: the trinity of data-scarce learning of polymer properties

Ning Liu, Siavash Jafarzadeh, Brian Y. Lattimer, Shuna Ni, Jim Lua, Yue Yu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10058 2024-06-06 cs.CL 90%

Towards Safer Large Language Models through Machine Unlearning

Zheyuan Liu, Guangyao Dou, Zhaoxuan Tan, Yijun Tian, Meng Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Accepted by ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14125 2024-06-05 cs.CV cs.AI 90%

VideoPoet: A Large Language Model for Zero-Shot Video Generation

Dan Kondratyuk, Lijun Yu, Xiuye Gu, José Lezama, Jonathan Huang, Grant Schindler, Rachel Hornung, Vighnesh Birodkar, Jimmy Yan, Ming-Chang Chiu, Krishna Somandepalli, Hassan Akbari, Yair Alon, Yong Cheng, Josh Dillon, Agrim Gupta, Meera Hahn, Anja Hauth, David Hendon, Alonso Martinez, David Minnen, Mikhail Sirotenko, Kihyuk Sohn, Xuan Yang, Hartwig Adam, Ming-Hsuan Yang, Irfan Essa, Huisheng Wang, David A. Ross, Bryan Seybold, Lu Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments To appear at ICML 2024; Project page: http://sites.research.google/videopoet/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14490 2024-05-24 cs.CL 90%

Impact of Non-Standard Unicode Characters on Security and Comprehension in Large Language Models

Johan S Daniel, Anand Pal

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

Comments 46 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04659 2024-04-09 cs.CL 90%

Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only Shallowly

Changjiang Gao, Hongda Hu, Peng Hu, Jiajun Chen, Jixing Li, Shujian Huang

专题命中 预训练与数据 :instruction tuning(title,abstract);pretraining(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07648 2024-04-05 cs.DC cs.LG 90%

Characterization of Large Language Model Development in the Datacenter

Qinghao Hu, Zhisheng Ye, Zerui Wang, Guoteng Wang, Meng Zhang, Qiaoling Chen, Peng Sun, Dahua Lin, Xiaolin Wang, Yingwei Luo, Yonggang Wen, Tianwei Zhang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03550 2024-03-07 cs.AI cs.CY cs.HC 90%

Emotional Manipulation Through Prompt Engineering Amplifies Disinformation Generation in AI Large Language Models

Rasita Vinay, Giovanni Spitale, Nikola Biller-Andorno, Federico Germani

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07312 2023-08-23 cs.CL 90%

Using Large Language Models for Zero-Shot Natural Language Generation from Knowledge Graphs

Agnes Axelsson, Gabriel Skantze

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments 9 pages, 3 pages appendices, 1 figure, 4 tables (incl. appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02250 2023-07-24 cs.IR cs.CL 90%

Large Language Model Augmented Narrative Driven Recommendations

Sheshera Mysore, Andrew McCallum, Hamed Zamani

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments RecSys 2023 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10998 2023-05-25 cs.CL 90%

The Web Can Be Your Oyster for Improving Large Language Models

Junyi Li, Tianyi Tang, Wayne Xin Zhao, Jingyuan Wang, Jian-Yun Nie, Ji-Rong Wen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments This work has been accepted by ACL 2023 (findings), while we slightly revise the title and the content based on the conference version

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09067 2023-05-17 cs.CL 90%

SGP-TOD: Building Task Bots Effortlessly via Schema-Guided LLM Prompting

Xiaoying Zhang, Baolin Peng, Kun Li, Jingyan Zhou, Helen Meng

专题命中 预训练与数据 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments 21 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23640 2026-08-26 cs.AI cs.CL cs.CY 新提交 90%

Auditing the Synthetic Memoir: Measuring Scene-Level Confabulation in LLM-Generated Autobiography Against the Documented Record of the Life It Describes

审计合成回忆录:对照人生的文献记录,测量大语言模型生成自传中的场景层面虚构

Heather Renze

机构 * Serenze Global(塞伦兹全球)

专题命中 预训练与数据 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文对照人生真实语料库审计LLM生成的自传,发现96.7%的场景验证失败,提出了可重复使用的审计工具及基于真实信息的补救方法。

Comments 20 pages, 4 figures, 6 tables. Code and derived data available at https://github.com/heathriel/synthetic-memoir-audit

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20281 2026-08-21 cs.CL cs.AI 新提交 90%

Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization

注入、对齐、恢复:用于无需检索的文档知识内化的分阶段后训练

Qian Kou, Xiaofeng Shi, Xiaosong Qiu, Hua Zhou

专题命中 预训练与数据 :post-training(title,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对大型语言模型无需检索文档时无法回答相关问题的痛点,提出IAR三阶段后训练框架,在多数据集、多模型上显著提升了文档知识内化的领域与通用性能。

Comments 21 pages, 4 figures. Includes Supplementary Material Sections A--G. Qian Kou and Xiaofeng Shi contributed equally and are co-corresponding authors. Hua Zhou is the project leader

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13866 2026-08-17 cs.LG cs.CL 新提交 90%

Geometric Filtering of LLM-Generated Samples for Few-Shot Text Classification

用于小样本文本分类的大语言模型生成样本的几何过滤

Benjamín Schindler, Gonzalo A. Ruz

专题命中 预训练与数据 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究针对LLM生成样本质量异质性问题,提出基于句子嵌入空间欧氏距离的几何过滤框架,结合软加权机制提升小样本文本分类性能,在多任务、多模型及多配置下均表现优异。

Comments 6 pages, 2 figures, to be published in IEEE LACCI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏