arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-13 至 2025-11-13 共收录 183 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 11 篇

2511.08877 2025-11-13 cs.CL cs.AI 91%

Hallucinate or Memorize? The Two Sides of Probabilistic Learning in Large Language Models

Junichiro Niimi

机构 * Meijo University(名古屋大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12602 2025-11-13 cs.LG physics.bio-ph 88%

SynLlama: Generating Synthesizable Molecules and Their Analogs with Large Language Models

Kunyang Sun, Dorian Bagni, Joseph M. Cavanagh, Yingze Wang, Jacob M. Sawyer, Bo Zhou, Andrew Gritsevskiy, Oufan Zhang, Teresa Head-Gordon

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17289 2025-11-13 cs.CL 86%

Automated Knowledge Graph Construction using Large Language Models and Sentence Complexity Modelling

Sydney Anuyah, Mehedi Mahmud Kaushik, Krishna Dwarampudi, Rakesh Shiradkar, Arjan Durresi, Sunandan Chakraborty

机构 * Indiana University(印第安纳大学) Purdue University(普渡大学) Department of Biomedical Engineering(生物医学工程系) Informatics, Indiana University(印第安纳大学信息学院)

专题命中 预训练与数据 :large language model(title);language model(title);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08861 2025-11-13 cs.LG cs.HC 83%

EEG-X: Device-Agnostic and Noise-Robust Foundation Model for EEG

Navid Mohammadi Foumani, Soheila Ghane, Nam Nguyen, Mahsa Salehi, Geoffrey I. Webb, Geoffrey Mackellar

机构 * Emotiv Research(Emotiv研究)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09213 2025-11-13 cs.CL 79%

Pretraining Finnish ModernBERTs

Akseli Reunamo, Laura-Maria Peltonen, Hans Moen, Sampo Pyysalo

机构 * University of Turku, Department of Computing(图尔库大学计算机系) University of Eastern Finland and Kuopio University Hospital(东方芬兰大学和库奥皮奥大学医院) University of Turku and Turku University Hospital(图尔库大学和图尔库大学医院) Aalto University, Department of Computer Science(艾尔沃普大学计算机科学系)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04432 2025-11-13 cs.CL 79%

Can Language Models Handle a Non-Gregorian Calendar? The Case of the Japanese wareki

Mutsumi Sasaki, Go Kamoda, Ryosuke Takahashi, Kosuke Sato, Kentaro Inui, Keisuke Sakaguchi, Benjamin Heinzerling

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted to IJCNLP-AACL 2025 (Main). Code available at https://github.com/cl-tohoku/Non-Gregorian-Calendar

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04697 2025-11-13 cs.CR cs.AI cs.CL 79%

Privacy-Preserving Retrieval-Augmented Generation with Differential Privacy

Tatsuki Koga, Ruihan Wu, Zhiyuan Zhang, Kamalika Chaudhuri

机构 * University of California, San Diego(加州大学圣迭戈分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06151 2025-11-13 cs.CR cs.AI 77%

Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems

Haowei Wang, Rupeng Zhang, Junjie Wang, Mingyang Li, Yuekai Huang, Dandan Wang, Qing Wang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09221 2025-11-13 cs.IT cs.AI math.IT 57%

Learning Binary Autoencoder-Based Codes with Progressive Training

Vukan Ninkovic, Dejan Vukobratovic

机构 * The Institute for Artificial Intelligence Research and Development of Serbia(塞尔维亚人工智能研究与发展研究所) Faculty of Technical Sciences, University of Novi Sad(诺维萨德大学技术科学学院)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

Comments Invited paper at TELFOR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03288 2025-11-13 cs.MA cs.GT econ.GN q-fin.EC 50%

Game Theory and Multi-Agent Reinforcement Learning for Zonal Ancillary Markets

Francesco Morri, Hélène Le Cadre, Pierre Gruet, Luce Brotcorne

专题命中 预训练与数据 :pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00449 2025-11-13 cs.CV 50%

LangPose: Language-Aligned Motion for Robust 3D Human Pose Estimation

Longyun Liao, Rong Zheng

机构 * McMaster University(麦斯特大学)

专题命中 预训练与数据 :pretraining(abstract)

Comments Accepted by WACV2026. Please find the supplementary material under the "Ancillary files"

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 22 篇

2511.01634 2025-11-13 cs.CR cs.AI 89%

Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models

Daniyal Ganiuly, Assel Smaiyl

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09438 2025-11-13 cs.LG cs.AI 89%

LLM-Guided Dynamic-UMAP for Personalized Federated Graph Learning

Sai Puppala, Ismail Hossain, Md Jahangir Alam, Tanzim Ahad, Sajedul Talukder

机构 * University of Texas at El Paso(德克萨斯理工大学) Southern Illinois University Carbondale(南方伊利诺伊大学卡本代尔分校)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08968 2025-11-13 cs.LG cs.CL 88%

Bayesian Mixture of Experts For Large Language Models

Maryam Dialameh, Hossein Rajabzadeh, Weiwei Zhang, Walid Ahmed, Hyock Ju Kwon

机构 * University of Waterloo(滑铁卢大学) Ascend Team, Huawei Technologies(华为技术有限公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08597 2025-11-13 cs.CL cs.AI 88%

Self-HarmLLM: Can Large Language Model Harm Itself?

Heehwan Kim, Sungjune Park, Daeseon Choi

机构 * Soongsil University(首尔大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23015 2025-11-13 cs.CL 88%

Detecting Stealthy Backdoor Samples based on Intra-class Distance for Large Language Models

Jinwen Chen, Hainan Zhang, Fei Sun, Qinnan Zhang, Sijia Wen, Ziwei Wang, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(未来区块链与隐私计算先进创新中心) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP2025Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08620 2025-11-13 cs.CL cs.AI cs.LG 87%

Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM

Yibai Liu, Shihang Wang, Zeming Liu, Zheming Song, Junzhe Wang, Jingjing Liu, Qingjie Liu, Yunhong Wang

机构 * Fu Foundation School of Engineering and Applied Science, Columbia University(哥伦比亚大学工程与应用科学学院) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08590 2025-11-13 cs.CL cs.LG 86%

GMTRouter: Personalized LLM Router over Multi-turn User Interactions

Encheng Xie, Yihang Sun, Tao Feng, Jiaxuan You

机构 * Antiquus S. Hippocampus, Natalia Cerebro & Amelie P. Amygdale Department of Computer Science Cranberry-Lemon University Pittsburgh, PA 15213, USA(计算机科学系,Cranberry-Lemon大学) Ji Q. Ren & Yevgeny LeNet Department of Computational Neuroscience University of the Witwatersrand Joburg, South Africa(计算神经科学系,沃特瓦特斯兰大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02615 2025-11-13 astro-ph.IM cs.AI 85%

Radio Astronomy in the Era of Vision-Language Models: Prompt Sensitivity and Adaptation

Mariia Drozdova, Erica Lastufka, Vitaliy Kinakh, Taras Holotyak, Daniel Schaerer, Slava Voloshynovskiy

机构 * University of Geneva(日内瓦大学)

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);prompting(abstract);分类 cs.AI

Comments Machine Learning and the Physical Sciences Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22493 2025-11-13 cs.CY cs.CL cs.LG 85%

A Detailed Factor Analysis for the Political Compass Test: Navigating Ideologies of Large Language Models

Sadia Kamal, Lalu Prasad Yadav Prakash, S M Rafiuddin, Mohammed Rakib, Atriya Sen, Sagnik Ray Choudhury

机构 * Oklahoma State University(俄克拉荷马州立大学) University of North Texas(北德克萨斯大学)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02671 2025-11-13 cs.CV 82%

Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models

Haoyang Li, Liang Wang, Chao Wang, Siyu Zhou, Jing Jiang, Yan Peng, Guodong Long

专题命中 指令微调 :language model(title,abstract);large language model(abstract)

Comments 16 pages, 6 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09092 2025-11-13 cs.AI math.OC 81%

OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning

Zezhen Ding, Zhen Tan, Jiheng Zhang, Tianlong Chen

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 9 pages, 5 figures, AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05478 2025-11-13 cs.LG cs.CL cs.IR 79%

GraphRAFT: Retrieval Augmented Fine-Tuning for Knowledge Graphs on Graph Databases

Alfred Clemedtson, Borun Shi

机构 * Neo4j

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16021 2025-11-13 cs.CL 77%

X-Troll: eXplainable Detection of State-Sponsored Information Operations Agents

Lin Tian, Xiuzhen Zhang, Maria Myung-Hee Kim, Jennifer Biggs, Marian-Andrei Rizoiu

机构 * University of Technology Sydney(悉尼技术大学) RMIT University(皇家墨尔本理工大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 15 pages, 5 figures, 4 tables, accepted by CIKM2025

Journal ref Proceedings of the 34th ACM International Conference on Information and Knowledge Management, pp 2874--2884. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08806 2025-11-13 cs.CL 74%

Toward Automated Cognitive Assessment in Parkinson's Disease Using Pretrained Language Models

Varada Khanna, Nilay Bhatt, Ikgyu Shin, Sule Tinaz, Yang Ren, Hua Xu, Vipina K. Keloth

专题命中 指令微调 :language model(title);分类 cs.CL

Comments 15 pages, 4 figures, 1 table. Varada Khanna and Nilay Bhatt are co-first authors. Sule Tinaz and Hua Xu are co-senior authors. Corresponding author: Vipina K. Keloth (vipina.kuttichikeloth@yale.edu)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04387 2025-11-13 cs.CL cs.AI 73%

FedP$^2$EFT: Federated Learning to Personalize PEFT for Multilingual LLMs

Royson Lee, Minyoung Kim, Fady Rezk, Rui Li, Stylianos I. Venieris, Timothy Hospedales

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at the 40th Annual AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03528 2025-11-13 cs.CL 70%

Fine-Tuning on Noisy Instructions: Effects on Generalization and Performance

Ahmed Alajrami, Xingwei Tan, Nikolaos Aletras

机构 * Department of Computer Science University of Sheffield, UK(计算机科学系 剑桥大学谢菲尔德分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to AACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19594 2025-11-13 cs.CL 70%

Understanding and Leveraging the Expert Specialization of Context Faithfulness in Mixture-of-Experts LLMs

Jun Bai, Minghao Tong, Yang Liu, Zixia Jia, Zilong Zheng

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04001 2025-11-13 cs.IR cs.CL 70%

ConvMix: A Mixed-Criteria Data Augmentation Framework for Conversational Dense Retrieval

Fengran Mo, Jinghan Zhang, Yuchen Hui, Jia Ao Sun, Zhichao Xu, Zhan Su, Jian-Yun Nie

机构 * Fengran Mo 1(摩峰ran 1) Jinghan Zhang 2(张 Jinghan 2) Yuchen Hui 1(慧 Yuchen 1) Jia Ao Sun 1(Sun Jia Ao 1) Zhichao Xu 3(徐 Zhichao 3) Zhan Su 1(苏 Zhan 1) Jian-Yun Nie 1(Nie Jian-Yun 1)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07722 2025-11-13 cs.AI 70%

Is Cognition Consistent with Perception? Assessing and Mitigating Multimodal Knowledge Conflicts in Document Understanding

Zirui Shao, Feiyu Gao, Zhaoqing Zhu, Chuwei Luo, Hangdi Xing, Zhi Yu, Qi Zheng, Ming Yan, Jiajun Bu

机构 * Zhejiang Key Laboratory of Accessible Perception and Intelligent Systems, Zhejiang University(浙江可感知智能系统重点实验室,浙江大学) Alibaba Group(阿里巴巴集团) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and DataSecurity(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏