arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-16 至 2025-09-16 共收录 266 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 18 篇

2509.11496 2025-09-16 cs.CL 91%

AKCIT-FN at CheckThat! 2025: Switching Fine-Tuned SLMs and LLM Prompting for Multilingual Claim Normalization

Fabrycio Leite Nakano Almada, Kauan Divino Pouso Mariano, Maykon Adriell Dutra, Victor Emanuel da Silva Monteiro, Juliana Resplande Sant'Anna Gomes, Arlindo Rodrigues Galvão Filho, Anderson da Silva Soares

机构 * Institute of Informatics, Federal University of Goiás, Brazil(信息学院,戈亚斯联邦大学,巴西) Advanced Knowledge Center in Immersive Technology (AKCIT), Federal University of Goiás, Brazil(沉浸式技术高级知识中心(AKCIT),戈亚斯联邦大学,巴西)

专题命中 预训练与数据 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13380 2025-09-16 cs.CL cs.AI 90%

Persona-Based Synthetic Data Generation Using Multi-Stage Conditioning with Large Language Models for Emotion Recognition

Keito Inoshita, Rushia Harada

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00979 2025-09-16 cs.CL cs.AI 88%

Synthesize-on-Graph: Knowledgeable Synthetic Data Generation for Continue Pre-training of Large Language Models

Shengjie Ma, Xuhui Jiang, Chengjin Xu, Cehao Yang, Liyu Zhang, Jian Guo

机构 * DataArc Tech Ltd.(DataArc科技有限公司) IDEA Research, International Digital Economy Academy(IDEA研究所、国际数字经济学院) Gaoling School of Artificial Intelligence, Renmin University of China(法律人工智能学院,中国人民大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16980 2025-09-16 cs.LG 87%

Safety Pretraining: Toward the Next Generation of Safe AI

Pratyush Maini, Sachin Goyal, Dylan Sam, Alex Robey, Yash Savani, Yiding Jiang, Andy Zou, Matt Fredrikson, Zacharcy C. Lipton, J. Zico Kolter

专题命中 预训练与数据 :pretraining(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11414 2025-09-16 cs.CL 85%

Continually Adding New Languages to Multilingual Language Models

Abraham Toluwase Owodunni, Sachin Kumar

机构 * Department of Computer Science and Engineering(计算机科学与工程系) The Ohio State University(俄亥俄州立大学)

专题命中 预训练与数据 :language model(title,abstract);instruction tuning(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03303 2025-09-16 cs.CL cs.AI cs.LG 85%

Hopscotch: Discovering and Skipping Redundancies in Language Models

Mustafa Eyceoz, Nikhil Shivakumar Nayak, Hao Wang, Ligong Han, Akash Srivastava

机构 * Red Hat AI Innovation(红帽AI创新)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 4 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04689 2025-09-16 cs.CL cs.AI cs.LG 85%

Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models

Thao Nguyen, Yang Li, Olga Golovneva, Luke Zettlemoyer, Sewoong Oh, Ludwig Schmidt, Xian Li

机构 * FAIR at Meta(Meta 的 FAIR 研究所) University of Washington(华盛顿大学) Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10486 2025-09-16 cs.NI cs.AI cs.LG cs.MM 81%

SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning

Pengcheng Luo, Yunyang Zhao, Bowen Zhang, Genke Yang, Boon-Hee Soong, Chau Yuen

机构 * Ningbo Artificial Intelligence Institute, Shanghai Jiao Tong University, Ningbo, China(宁波人工智能研究院,上海交通大学,宁波,中国) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(自动化与智能感知学院,上海交通大学,上海,中国) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电子与电气工程学院,南洋理工大学,新加坡)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12766 2025-09-16 cs.CL cs.AI cs.LG 80%

Understanding Emergent In-Context Learning from a Kernel Regression Perspective

Chi Han, Ziqi Wang, Han Zhao, Heng Ji

机构 * Siebel School of Computing and Data Science(计算与数据科学学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Transactions on Machine Learning Research (TMLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12193 2025-09-16 cs.CV 78%

Domain-Adaptive Pretraining Improves Primate Behavior Recognition

Felix B. Mueller, Timo Lueddecke, Richard Vogg, Alexander S. Ecker

机构 * Institute of Computer Science and Campus Institute Data Science, University of Göttingen(计算机科学研究所和校园数据科学研究所,哥廷根大学) Max Planck Institute for Dynamics and Self-Organization(动态与自组织Max Planck研究所)

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Oral at the CVPR 2025 Workshop CV4Animals

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11141 2025-09-16 cs.CL 77%

When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity

Shiyao Cui, Xijia Feng, Yingkang Wang, Junxiao Yang, Zhexin Zhang, Biplab Sikdar, Hongning Wang, Han Qiu, Minlie Huang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10538 2025-09-16 cs.LG cs.AI cs.CL cs.CY 75%

DualAlign: Generating Clinically Grounded Synthetic Data

Rumeng Li, Xun Wang, Hong Yu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11176 2025-09-16 cs.CL cs.AI 73%

Differentially-private text generation degrades output language quality

Erion Çano, Ivan Habernal

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 3 figures, 35 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17767 2025-09-16 cs.CL cs.LG 73%

ISACL: Internal State Analyzer for Copyrighted Training Data Leakage

Guangwei Zhang, Qisheng Su, Jiateng Liu, Cheng Qian, Yanzhou Pan, Yanjie Fu, Denghui Zhang

机构 * City University of Hong Kong(香港城市大学) Microsoft(微软) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google LLC(谷歌公司) Arizona State University(亚利桑那州立大学) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10860 2025-09-16 cs.CL 70%

Quantifier Scope Interpretation in Language Learners and LLMs

Shaohua Fang, Yue Li, Yan Cong

机构 * Department of English, Purdue University(英语系,普渡大学) Department of Linguistics, Purdue University(语言学系,普渡大学) School of Languages and Cultures, Purdue University(语言与文化学院,普渡大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10424 2025-09-16 cs.CV cs.AI 70%

What is the Visual Cognition Gap between Humans and Multimodal LLMs?

Xu Cao, Yifan Shen, Bolin Lai, Wenqian Ye, Yunsheng Ma, Joerg Heintz, Jintai Chen, Meihuan Huang, Jianguo Cao, Aidong Zhang, James M. Rehg

机构 * Department of Computer Science, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系) College of Computing, Georgia Institute of Technology(佐治亚理工学院计算机学院) Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系) Digital Twin Lab, Purdue University(普渡大学数字孪生实验室) HKUST (Guangzhou)(香港科技大学(广州)) Department of Rehabilitation Medicine, Shenzhen Children’s Hospital(深圳儿童医院康复医学系)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11201 2025-09-16 cs.CV 50%

Scaling Up Forest Vision with Synthetic Data

Yihang She, Andrew Blake, David Coomes, Srinivasan Keshav

机构 * University of Cambridge(剑桥大学)

专题命中 预训练与数据 :pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13441 2025-09-16 cs.RO 50%

GraspMolmo: Generalizable Task-Oriented Grasping via Large-Scale Synthetic Data Generation

Abhay Deshpande, Yuquan Deng, Arijit Ray, Jordi Salvador, Winson Han, Jiafei Duan, Kuo-Hao Zeng, Yuke Zhu, Ranjay Krishna, Rose Hendrix

机构 * Allen Institute for AI(Allen人工智能研究所) Boston University(波士顿大学) University of Washington(华盛顿大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 预训练与数据 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 15 篇

2509.12110 2025-09-16 eess.SP cs.CL cs.LG 90%

When marine radar target detection meets pretrained large language models

Qiying Hu, Linping Zhang, Xueqian Wang, Gang Li, Yu Liu, Xiao-Ping Zhang

机构 * Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学) State Key Laboratory of Space Network and Communications, Tsinghua University(空间网络与通信国家重点实验室,清华大学) Shenzhen Key Laboratory of Ubiquitous Data Enabling, Tsinghua Shenzhen International Graduate School, Tsinghua University(深圳 ubiquitous 数据赋能重点实验室,清华大学深圳国际研究生院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12136 2025-09-16 cs.DC 87%

UniPar: A Unified LLM-Based Framework for Parallel and Accelerated Code Translation in HPC

Tomer Bitan, Tal Kadosh, Erel Kaplan, Shira Meiri, Le Chen, Peter Morales, Niranjan Hasabnis, Gal Oren

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to IEEE HPEC conference 2025. 9 pages, incl references

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11492 2025-09-16 cs.CL cs.AI 86%

ClaimIQ at CheckThat! 2025: Comparing Prompted and Fine-Tuned Language Models for Verifying Numerical Claims

Anirban Saha Anik, Md Fahimul Kabir Chowdhury, Andrew Wyckoff, Sagnik Ray Choudhury

机构 * Department of Data Science, University of North Texas, Denton, TX, USA(数据科学系,北卡罗来纳州立大学,德顿,得克萨斯州,美国) Department of Computer Science and Engineering, University of North Texas, Denton, TX, USA(计算机科学与工程系,北卡罗来纳州立大学,德顿,得克萨斯州,美国) Department of Computer Science(计算机科学系)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Notebook for the CheckThat! Lab at CLEF 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02465 2025-09-16 cs.CL cs.AI 86%

Revealing the Inherent Instructability of Pre-Trained Language Models

Seokhyun An, Minji Kim, Hyounghun Kim

机构 * Department of Computer Science and Engineering, UNIST(UNIST计算机科学与工程系) Graduate School of Artificial Intelligence, POSTECH(POSTECH人工智能研究生院) Department of Computer Science and Engineering, POSTECH(POSTECH计算机科学与工程系)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

Comments Findings of EMNLP 2025 (32 pages). Code available at https://github.com/seokhyunan/response-tuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10478 2025-09-16 cs.NI cs.LG cs.SY eess.SY 85%

The LLM as a Network Operator: A Vision for Generative AI in the 6G Radio Access Network

Oluwaseyi Giwa, Michael Adewole, Tobi Awodumila, Pelumi Aderinto

机构 * African Institute for Mathematical Sciences(非洲数学科学研究所)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Submitted to Workshop on AI and ML for Next-Generation Wireless Communications and Networking, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11167 2025-09-16 cs.LG cs.AI 82%

Harnessing Optimization Dynamics for Curvature-Informed Model Merging

Pouria Mahdavinia, Hamed Mahdavi, Niloofar Mireshghallah, Mehrdad Mahdavi

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15007 2025-09-16 cs.AI 79%

RouteFinder: Towards Foundation Models for Vehicle Routing Problems

Federico Berto, Chuanbo Hua, Nayeli Gast Zepeda, André Hottung, Niels Wouda, Leon Lan, Junyoung Park, Kevin Tierney, Jinkyoo Park

机构 * KAIST(韩国科学技术院) Bielefeld University(比勒菲尔德大学) Rotterdam School of Management(鹿特丹管理学院) VU Amsterdam(阿姆斯特丹自由大学) Omelet AI4CO

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

Comments TMLR 2025. A previous version of this work was presented as Oral at the ICML 2024 FM-Wild Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10513 2025-09-16 cs.LG 79%

Mixture-of-Clustered-Experts: Advancing Expert Specialization and Generalization in Instruction Tuning

Sugyeong Eo, Jungjun Lee, Chanjun Park, Heuiseok Lim

机构 * Department of Computer Science and Engineering, Korea University, Republic of Korea(韩国大学计算机科学与工程系) KT, Republic of Korea(韩国KT) School of Software, Soongsil University, Republic of Korea(顺天大学软件学院)

专题命中 指令微调 :instruction tuning(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10469 2025-09-16 cs.IR cs.AI cs.CL 79%

Real-Time RAG for the Identification of Supply Chain Vulnerabilities

Jesse Ponnock, Grace Kenneally, Michael Robert Briggs, Elinor Yeo, Tyrone Patterson, Nicholas Kinberg, Matthew Kalinowski, David Hechtman

机构 * MITRE Corporation(MITRE公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures, 1 table. Approved for Public Release; Distribution Unlimited. PRS Release Number: 25-0864

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14707 2025-09-16 cs.CV 78%

Seeing Further on the Shoulders of Giants: Knowledge Inheritance for Vision Foundation Models

Jiabo Huang, Chen Chen, Lingjuan Lyu

专题命中 指令微调 :foundation model(title,abstract)

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10932 2025-09-16 cs.AI cs.CL 73%

Public Data Assisted Differentially Private In-Context Learning

Seongho Joo, Hyukhun Koh, Kyomin Jung

机构 * Seoul National University(首尔国立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14383 2025-09-16 cs.CL 70%

Rumor Detection by Multi-task Suffix Learning based on Time-series Dual Sentiments

Zhiwei Liu, Kailai Yang, Eduard Hovy, Sophia Ananiadou

机构 * The University of Manchester(曼彻斯特大学) The University of Melbourne(墨尔本大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :LLM(abstract);prompting(abstract);分类 cs.CL

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏