arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12429 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2410.11300 2024-10-16 cs.SE 88%

Instructive Code Retriever: Learn from Large Language Model's Feedback for Code Intelligence Tasks

Jiawei Lu, Haoye Wang, Zhongxin Liu, Keyu Liang, Lingfeng Bao, Xiaohu Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments to appear at the 39th IEEE/ACM International Conference on Automated Software Engineering (ASE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08683 2024-10-14 cs.CV 88%

SEED-Story: Multimodal Long Story Generation with Large Language Model

Shuai Yang, Yuying Ge, Yang Li, Yukang Chen, Yixiao Ge, Ying Shan, Yingcong Chen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments Our models, codes and datasets are released in https://github.com/TencentARC/SEED-Story

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19021 2024-10-01 hep-ph physics.ed-ph 88%

ChatQCD: Let Large Language Models Explore QCD

Antonin Sulc, Patrick L. S. Connor

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments 3 pages, 0 figure, conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06166 2024-09-11 cs.CV 88%

Revisiting Prompt Pretraining of Vision-Language Models

Zhenyuan Chen, Lingfeng Yang, Shuo Chen, Zhaowei Chen, Jiajun Liang, Xiang Li

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03286 2024-07-04 cs.DB 88%

Large Language Models for JSON Schema Discovery

Michael J. Mior

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14991 2024-06-18 cs.IR 88%

A Short Review for Ontology Learning: Stride to Large Language Models Trend

Rick Du, Huilong An, Keyu Wang, Weidong Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04659 2024-06-10 cs.CV 88%

LocLLM: Exploiting Generalizable Human Keypoint Localization via Large Language Model

Dongkai Wang, Shiyu Xuan, Shiliang Zhang

专题命中 预训练与数据 :language model(title,abstract);large language model(title);LLM(abstract)

Comments CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00516 2024-05-31 cs.LG cs.AI cs.CL 88%

Navigating WebAI: Training Agents to Complete Web Tasks with Large Language Models and Reinforcement Learning

Lucas-Andreï Thil, Mirela Popa, Gerasimos Spanakis

专题命中 预训练与数据 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

Comments ACM 2024, Avila Spain. 9 pages

Journal ref Proceedings of the 39th ACM/SIGAPP Symposium on Applied Computing, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02314 2024-05-29 cs.LG cs.AI cs.CL 88%

Selecting Large Language Model to Fine-tune via Rectified Scaling Law

Haowei Lin, Baizhou Huang, Haotian Ye, Qinyu Chen, Zihao Wang, Sujian Li, Jianzhu Ma, Xiaojun Wan, James Zou, Yitao Liang

专题命中 预训练与数据 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11466 2024-05-21 cs.SE 88%

Measuring Impacts of Poisoning on Model Parameters and Embeddings for Large Language Models of Code

Aftab Hussain, Md Rafiqul Islam Rabin, Mohammad Amin Alipour

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments This work has been accepted at the 1st ACM International Conference on AI-powered Software (AIware), co-located with the ACM International Conference on the Foundations of Software Engineering (FSE) 2024, Porto de Galinhas, Brazil. arXiv admin note: substantial text overlap with arXiv:2402.12936

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04164 2024-05-08 cs.CV 88%

Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation

Ryan Wong, Necati Cihan Camgoz, Richard Bowden

专题命中 预训练与数据 :language model(title,abstract);large language model(title);pretraining(abstract)

Comments Accepted at ICLR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16118 2024-04-26 cs.CR 88%

Act as a Honeytoken Generator! An Investigation into Honeytoken Generation with Large Language Models

Daniel Reti, Norman Becker, Tillmann Angeli, Anasuya Chattopadhyay, Daniel Schneider, Sebastian Vollmer, Hans D. Schotten

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20317 2024-04-01 cs.CV 88%

Convolutional Prompting meets Language Models for Continual Learning

Anurag Roy, Riddhiman Moulick, Vinay K. Verma, Saptarshi Ghosh, Abir Das

专题命中 预训练与数据 :language model(title,abstract);prompting(title);large language model(abstract)

Comments CVPR 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16948 2024-03-26 cs.IR 88%

Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling

Jie Wang, Alexandros Karatzoglou, Ioannis Arapakis, Joemon M. Jose

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06748 2023-12-27 cs.DB 88%

DTT: An Example-Driven Tabular Transformer for Joinability by Leveraging Large Language Models

Arash Dargahi Nobari, Davood Rafiei

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments To appear in SIGMOD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04004 2023-12-12 cs.SE 88%

Occlusion-based Detection of Trojan-triggering Inputs in Large Language Models of Code

Aftab Hussain, Md Rafiqul Islam Rabin, Toufique Ahmed, Mohammad Amin Alipour, Bowen Xu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06530 2023-11-30 cs.SE 88%

Refining Decompiled C Code with Large Language Models

Wai Kin Wong, Huaijin Wang, Zongjie Li, Zhibo Liu, Shuai Wang, Qiyi Tang, Sen Nie, Shi Wu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12955 2023-11-23 cs.IR 88%

Don't forget private retrieval: distributed private similarity search for large language models

Guy Zyskind, Tobin South, Alex Pentland

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12523 2023-10-20 cs.CR 88%

Privacy Preserving Large Language Models: ChatGPT Case Study Based Vision and Framework

Imdad Ullah, Najm Hassan, Sukhpal Singh Gill, Basem Suleiman, Tariq Ahamed Ahanger, Zawar Shah, Junaid Qadir, Salil S. Kanhere

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.04476 2023-09-04 cs.CV 88%

Towards Geospatial Foundation Models via Continual Pretraining

Matias Mendieta, Boran Han, Xingjian Shi, Yi Zhu, Chen Chen

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(title,abstract)

Comments ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15370 2023-07-31 cs.SE 88%

Private-Library-Oriented Code Generation with Large Language Models

Daoguang Zan, Bei Chen, Yongshun Gong, Junzhi Cao, Fengji Zhang, Bingchao Wu, Bei Guan, Yilong Yin, Yongji Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19912 2023-06-01 cs.IR 88%

Structure-Aware Language Model Pretraining Improves Dense Retrieval on Structured Data

Xinze Li, Zhenghao Liu, Chenyan Xiong, Shi Yu, Yu Gu, Zhiyuan Liu, Ge Yu

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract)

Comments Accepted by Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14038 2023-03-27 cs.CV 88%

Accelerating Vision-Language Pretraining with Free Language Modeling

Teng Wang, Yixiao Ge, Feng Zheng, Ran Cheng, Ying Shan, Xiaohu Qie, Ping Luo

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract)

Comments To appear in CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.14115 2023-03-22 cs.CV cs.AI cs.CL cs.LG 88%

Vid2Seq: Large-Scale Pretraining of a Visual Language Model for Dense Video Captioning

Antoine Yang, Arsha Nagrani, Paul Hongsuck Seo, Antoine Miech, Jordi Pont-Tuset, Ivan Laptev, Josef Sivic, Cordelia Schmid

专题命中 预训练与数据 :language model(title,abstract);pretraining(title);分类 cs.CL、cs.AI、cs.LG

Comments CVPR 2023 Camera-Ready; Project Webpage: https://antoyang.github.io/vid2seq.html ; 18 pages; 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13498 2023-02-28 cs.IR 88%

Pretraining De-Biased Language Model with Large-scale Click Logs for Document Ranking

Xiangsheng Li, Xiaoshu Chen, Kunliang Wei, Bin Hu, Lei Jiang, Zeqian Huang, Zhanhui Kang

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04501 2022-12-09 cs.CV 88%

Learning Video Representations from Large Language Models

Yue Zhao, Ishan Misra, Philipp Krähenbühl, Rohit Girdhar

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

Comments Tech report. Project page: https://facebookresearch.github.io/LaViLa; Code is available at http://github.com/facebookresearch/LaViLa

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19463 2026-08-21 cs.LG 新提交 87%

LLM as Detector: An In-context Learning Approach for Tabular Anomaly Detection

作为检测器的大语言模型:一种用于表格异常检测的上下文学习方法

Tu Anh Hoang Nguyen, Dang Nguyen, Thuc Duy Le, Trung Le, Sunil Gupta

机构 * Applied Artificial Intelligence Initiative (A2I2), Deakin University(应用人工智能计划(A2I2),迪肯大学) Adelaide University(阿德莱德大学) Monash University(莫纳什大学)

专题命中 预训练与数据 :LLM(title,summary_cn);分类 cs.LG

AI总结 本研究提出LLM-Detector框架,利用LLM的上下文学习能力进行表格异常检测,在24个数据集上对比15个SOTA基线均获提升,且无需微调或神经网络训练,降低了计算成本。

Comments Accepted at International Conference on Neural Information Processing (ICONIP) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31156 2026-08-19 cs.LG 版本更新 87%

TabCausal: Pretraining Across Causal Environments for Tabular Causal Discovery

TabCausal: 跨因果环境的表格因果发现预训练

Zi-Rong Li, Si-Yang Liu, Tian-Zuo Wang, Han-Jia Ye

机构 * Nanjing University(南京大学)

专题命中 预训练与数据 :pretraining(title,abstract);LLM(abstract,abstract_cn);foundation model(abstract);分类 cs.LG

AI总结 提出TabCausal,一种通过动态任务构建策略在多样化因果环境中进行大规模预训练的因果发现基础模型,在合成和语义基准上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11656 2026-08-13 cs.LG 新提交 87%

Continuous-Latent Predictive Modeling with Semantic Alignment for EEG-Language Foundation Models

面向EEG-语言基础模型的语义对齐连续隐式预测建模

Myeong-Ju Cho, Hye-Bin Shin, Seo-Hyun Lee, Seong-Whan Lee

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 本文提出BLPM模型,通过CELP编码器与MQSD模块对齐EEG语义,解决EEG基础模型预训练的关键挑战,在多基准任务中实现良好泛化。

Comments 19 pages, 3 figures; supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03883 2026-08-05 cs.CL 新提交 87%

DS@GT-ARC at eRisk 2026 Task 3: Sparse, Semantic, and LLM Reranking for ADHD Symptom Sentences

佐治亚理工学院DS团队参加eRisk 2026任务3:针对ADHD症状句子的稀疏、语义及大语言模型重排序

David Guecha

专题命中 预训练与数据 :LLM(title,summary_cn);分类 cs.CL

AI总结 本文介绍佐治亚理工学院DS团队针对eRisk 2026任务3,采用分阶段检索结合稀疏BM25、语义及LLM重排序的方案,其中LLM重排序器取得官方最优成绩,分阶段重排序具发展前景。

详情

展开后加载摘要…

URL PDF HTML 收藏