arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-14 至 2025-11-14 共收录 171 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 15 篇

2511.10093 2025-11-14 cs.CL cs.AI 91%

On the Military Applications of Large Language Models

Satu Johansson, Taneli Riihonen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);pretraining(abstract)

Comments Published in the meeting proceedings of the 2025 International Conference on Military Communications and Information Systems (ICMCIS) by the NATO Science and Technology Organization (STO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01252 2025-11-14 cs.CL cs.AI cs.LG 90%

GPT and Prejudice: A Sparse Approach to Understanding Learned Representations in Large Language Models

Mariam Mahran, Katharina Simbeck

机构 * HTW Berlin University of Applied Sciences(柏林应用科学大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint. Draft version, subject to revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10027 2025-11-14 cs.CL cs.AI 86%

LLMCARE: early detection of cognitive impairment via transformer models enhanced by LLM-generated synthetic data

Ali Zolnour, Hossein Azadmaleki, Yasaman Haghbin, Fatemeh Taherinezhad, Mohamad Javad Momeni Nezhad, Sina Rashidi, Masoud Khani, AmirSajjad Taleban, Samin Mahdizadeh Sani, Maryam Dadkhah, James M. Noble, Suzanne Bakken, Yadollah Yaghoobzadeh, Abdol-Hossein Vahabie, Masoud Rouhizadeh, Maryam Zolnoori

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10098 2025-11-14 cs.CV 85%

MTAttack: Multi-Target Backdoor Attacks against Large Vision-Language Models

Zihan Wang, Guansong Pang, Wenjun Miao, Jin Zheng, Xiao Bai

专题命中 预训练与数据 :language model(title,abstract);instruction tuning(abstract);pretraining(abstract)

Comments AAAI2026, with supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10591 2025-11-14 cs.CL cs.AI 81%

Mined Prompting and Metadata-Guided Generation for Wound Care Visual Question Answering

Bavana Durgapraveen, Sornaraj Sivasankaran, Abhinand Balachandran, Sriram Rajkumar

机构 * EXL Health AI Lab at MEDIQA-WV 2025(EXL健康AI实验室)

专题命中 预训练与数据 :prompting(title,abstract);分类 cs.CL、cs.AI

Comments 2 figures, 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12381 2025-11-14 cs.CL cs.AI 81%

From n-gram to Attention: How Model Architectures Learn and Propagate Bias in Language Modeling

Mohsinul Kabir, Tasfia Tahsin, Sophia Ananiadou

机构 * Department of Computer Science, National Center for Text Mining, The University of Manchester(计算机科学系,文本挖掘国家中心,曼彻斯特大学) Department of Computer Science and Engineering, Islamic University of Technology(计算机科学与工程系,伊斯兰技术大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025 (Findings)

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09665 2025-11-14 cs.LG 79%

Generalization Can Emerge in Tabular Foundation Models From a Single Table

Junwei Ma, Nour Shaheen, Alex Labach, Amine Mhedhbi, Frank Hutter, Anthony L. Caterini, Valentin Thomas

机构 * University of Toronto(多伦多大学) Polytechnique Montréal(蒙特利尔大学) Mila – Quebec AI Institute(魁北克人工智能研究所) Layer 6 AI(Layer 6 AI公司) Prior Labs(Prior实验室) ELLIS Institute(ELLIS研究所) Tübingen University of Freiburg(弗赖堡大学)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09958 2025-11-14 cs.CV cs.AI 70%

Zero-Shot Referring Expression Comprehension via Vison-Language True/False Verification

Jeffrey Liu, Rongbin Hu

专题命中 预训练与数据 :pretraining(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08207 2025-11-14 physics.comp-ph cond-mat.mtrl-sci cs.LG 70%

Are Foundational Atomistic Models Reliable for Finite-Temperature Molecular Dynamics?

Denan Li, Jiyuan Yang, Xiangkai Chen, Lintao Yu, Shi Liu

机构 * Department of Physics, School of Science, Westlake University, Hangzhou, Zhejiang 310030, China(物理系,科学学院,西湖大学,杭州,浙江 310030,中国)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09709 2025-11-14 cs.CL 70%

Contextual morphologically-guided tokenization for Latin encoder models

Marisa Hudspeth, Patrick J. Burns, Brendan O'Connor

机构 * Manning College of Information & Computer Sciences, University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校信息与计算机科学学院) Institute for the Study of the Ancient World, New York University(纽约大学古代世界研究所)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04369 2025-11-14 cs.CV 67%

TSPO: Temporal Sampling Policy Optimization for Long-form Video Language Understanding

Canhui Tang, Zifan Han, Hongbo Sun, Sanping Zhou, Xuchong Zhang, Xin Wei, Ye Yuan, Huayu Zhang, Jinglin Xu, Hao Sun

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09690 2025-11-14 cs.CL 57%

Omnilingual ASR: Open-Source Multilingual Speech Recognition for 1600+ Languages

Omnilingual ASR team, Gil Keren, Artyom Kozhevnikov, Yen Meng, Christophe Ropers, Matthew Setzler, Skyler Wang, Ife Adebara, Michael Auli, Can Balioglu, Kevin Chan, Chierh Cheng, Joe Chuang, Caley Droof, Mark Duppenthaler, Paul-Ambroise Duquenne, Alexander Erben, Cynthia Gao, Gabriel Mejia Gonzalez, Kehan Lyu, Sagar Miglani, Vineel Pratap, Kaushik Ram Sadagopan, Safiyyah Saleem, Arina Turkatenko, Albert Ventayol-Boada, Zheng-Xin Yong, Yu-An Chung, Jean Maillard, Rashel Moritz, Alexandre Mourachko, Mary Williamson, Shireen Yates

机构 * FAIR at Meta(Meta 的 FAIR 部门) Department of Sociology, McGill University(麦吉尔大学社会学系) Department of Modern Languages and Cultural Studies, University of Alberta(阿尔伯塔大学现代语言与文化研究系) Department of Computer Science, Brown University(布朗大学计算机科学系)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07486 2025-11-14 hep-ex cs.LG 57%

RINO: Renormalization Group Invariance with No Labels

Zichun Hao, Raghav Kansal, Abhijith Gandrakota, Chang Sun, Ngadiuba Jennifer, Javier Duarte, Maria Spiropulu

机构 * Division of Physics, Mathematics and Astronomy(物理、数学和天文学系) California Institute of Technology(加州理工学院) Particle Physics Division(粒子物理学系) Fermi National Accelerator Laboratory(费米加速器实验室) Department of Physics(物理系) University of California San Diego(加州大学圣地亚哥分校)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10212 2025-11-14 cs.CV 50%

Next-Frame Feature Prediction for Multimodal Deepfake Detection and Temporal Localization

Ashutosh Anshul, Shreyas Gopal, Deepu Rajan, Eng Siong Chng

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

专题命中 预训练与数据 :pretraining(abstract)

Comments Under Review, Multimodal Deepfake detection

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04685 2025-11-14 eess.AS cs.SD 50%

Say More with Less: Variable-Frame-Rate Speech Tokenization via Adaptive Clustering and Implicit Duration Coding

Rui-Chen Zheng, Wenrui Liu, Hui-Peng Du, Qinglin Zhang, Chong Deng, Qian Chen, Wen Wang, Yang Ai, Zhen-Hua Ling

专题命中 预训练与数据 :language model(abstract)

Comments Accepted to AAAI 2026. Project page: https://zhengrachel.github.io/VARSTok

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 7 篇

2501.14250 2025-11-14 cs.CL cs.AI cs.CR 87%

Siren: A Learning-Based Multi-Turn Attack Framework for Simulating Real-World Human Jailbreak Behaviors

Yi Zhao, Youzhi Zhang

机构 * Department of Computing The Hong Kong Polytechnic University Hong Kong SAR, China Centre for Artificial Intelligence Robotics Hong Kong Institute of Science \& Innovation Chinese Academy of Sciences Hong Kong SAR, China

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted at ACSAC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21597 2025-11-14 cs.CL cs.AI cs.LG 87%

Reducing the Scope of Language Models

David Yunis, Siyu Huo, Chulaka Gunasekara, Danish Contractor

机构 * Toyota Technological Institute at Chicago(丰田技术研究所(芝加哥)) IBM(IBM公司)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Appears in AAAI 2026 in the Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10229 2025-11-14 cs.CL 85%

LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction Tuning

Yangfan Ye, Xiaocheng Feng, Xiachong Feng, Lei Huang, Weitao Ma, Qichen Hong, Yunfei Lu, Duyu Tang, Dandan Tu, Bing Qin

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments AAAI2026 Main Track Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10244 2025-11-14 cs.AI 79%

PepTriX: A Framework for Explainable Peptide Analysis through Protein Language Models

Vincent Schilling, Akshat Dubey, Georges Hattab

机构 * Center for Artificial Intelligence in Public Health Research (ZKI-PH), Robert Koch Institute(人工智能与公共健康研究所以及罗伯特·科赫研究所) Department of Mathematics and Computer Science, Free University of Berlin(数学与计算机科学系,柏林自由大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09973 2025-11-14 cs.CV cs.AI 79%

Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models

Satoshi Suzuki, Shin'ya Yamaguchi, Shoichiro Takeda, Taiga Yamane, Naoki Makishima, Naotaka Kawata, Mana Ihori, Tomohiro Tanaka, Shota Orihashi, Ryo Masumura

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08238 2025-11-14 cs.CV cs.AI 57%

Remodeling Semantic Relationships in Vision-Language Fine-Tuning

Xiangyang Wu, Liu Liu, Baosheng Yu, Jiayan Qiu, Zhenwei Shi

机构 * Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Nanyang Technological University(南洋理工大学) University of Leicester(莱斯特大学) School of Astronautics, Beihang University(北京航空航天大学航天学院)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09870 2025-11-14 cs.CV 50%

SAM-DAQ: Segment Anything Model with Depth-guided Adaptive Queries for RGB-D Video Salient Object Detection

Jia Lin, Xiaofei Zhou, Jiyuan Liu, Runmin Cong, Guodao Zhang, Zhi Liu, Jiyong Zhang

专题命中 指令微调 :foundation model(abstract)

Comments Accepted to 40th AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 4 篇

2507.20067 2025-11-14 cs.AI cs.CL cs.LG 91%

PITA: Preference-Guided Inference-Time Alignment for LLM Post-Training

Sarat Chandra Bobbili, Ujwal Dinesha, Dheeraj Narasimha, Srinivas Shakkottai

机构 * Texas A&M University(德克萨斯A&M大学) Inria(法国国家信息与自动化研究所)

专题命中 后训练与偏好优化 :LLM(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10289 2025-11-14 eess.AS cs.CL 83%

Music Flamingo: Scaling Music Understanding in Audio Language Models

Sreyan Ghosh, Arushi Goel, Lasha Koroshinadze, Sang-gil Lee, Zhifeng Kong, Joao Felipe Santos, Ramani Duraiswami, Dinesh Manocha, Wei Ping, Mohammad Shoeybi, Bryan Catanzaro

机构 * NVIDIA, CA, USA(NVIDIA公司) University of Maryland, College Park, USA(大学)

专题命中 后训练与偏好优化 :language model(title,abstract);post-training(abstract);分类 cs.CL

Comments Project Page: https://research.nvidia.com/labs/adlr/MF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10165 2025-11-14 cs.LG q-bio.QM 79%

EPO: Diverse and Realistic Protein Ensemble Generation via Energy Preference Optimization

Yuancheng Sun, Yuxuan Ren, Zhaoming Chen, Xu Han, Kang Liu, Qiwei Ye

专题命中 后训练与偏好优化 :preference optimization(title,abstract);分类 cs.LG

Comments Accepted as AAAI 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10148 2025-11-14 cs.NE 78%

UCPO: A Universal Constrained Combinatorial Optimization Method via Preference Optimization

Zhanhong Fang, Debing Wang, Jinbiao Chen, Jiahai Wang, Zizhen Zhang

专题命中 后训练与偏好优化 :preference optimization(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 7 篇

2509.14289 2025-11-14 cs.AI cs.CL cs.LG 87%

From Capabilities to Performance: Evaluating Key Functional Properties of LLM Architectures in Penetration Testing

Lanxiao Huang, Daksh Dave, Tyler Cody, Peter Beling, Ming Jin

机构 * Bradley Department of Electrical and Computer Engineering, Virginia Tech(弗吉尼亚理工大学电气与计算机工程系布雷拉德部门) National Security Institute, Virginia Tech(弗吉尼亚理工大学国家安全研究所)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 15890 to 15916, Suzhou, China, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09971 2025-11-14 cs.CL 83%

NumPert: Numerical Perturbations to Probe Language Models for Veracity Prediction

Peter Røysland Aarnes, Vinay Setty

机构 * University of Stavanger(斯塔万格大学)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted in ICJNLP/AACL SRW

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17806 2025-11-14 cs.LG 79%

Caption, Create, Continue: Continual Learning with Pre-trained Generative Vision-Language Models

Indu Solomon, Aye Phyu Phyu Aung, Uttam Kumar, Senthilnath Jayavelu

机构 * International Institute of Information Technology Bangalore (IIITB), India(国际信息技术研究所(班加罗尔)) Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR), Singapore(信息与通信研究所(A*STAR))

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.LG

Comments This is the revised and peer-reviewed version of our paper, accepted and published in the Proceedings of the 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

Journal ref Proc. 34th ACM International Conference on Information and Knowledge Management (CIKM), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10277 2025-11-14 cs.AI cs.IR 77%

Fixed-Persona SLMs with Modular Memory: Scalable NPC Dialogue on Consumer Hardware

Martin Braas, Lukas Esterle

机构 * Andreasen 1(安德森实验室) Lukas Esterle 1,2(埃斯特勒实验室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏