arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-19 至 2025-11-19 共收录 195 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 13 篇

2503.14831 2025-11-19 eess.SP cs.LG 89%

Robust Transmission of Punctured Text with Large Language Model-based Recovery

Sojeong Park, Hyeonho Noh, Hyun Jong Yang

机构 * Department of Electrical Engineering, Pohang University of Science and Technology, Korea(首尔国立大学) Department of Electrical and Computer Engineering, Seoul National University, Korea(首尔国立大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments This work has been submitted to the IEEE for possible publication

Journal ref IEEE Transactions on Vehicular Technology, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14245 2025-11-19 cs.CL 89%

MuCPT: Music-related Natural Language Model Continued Pretraining

Kai Tian, Yirong Mao, Wendong Bi, Hanjie Wang, Que Wenhui

机构 * Tsinghua University(清华大学) Tencent Inc(腾讯公司)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14153 2025-11-19 cs.LG cs.CY 89%

A Comprehensive Study of Implicit and Explicit Biases in Large Language Models

Fatima Kazi, Alex Young, Yash Inani, Setareh Rafatirad

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14926 2025-11-19 cs.CL cs.AI cs.LG 89%

Patent Language Model Pretraining with ModernBERT

Amirhossein Yousefiramandi, Ciaran Cooney

机构 * Clarivate

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14738 2025-11-19 cs.LG 88%

LAUD: Integrating Large Language Models with Active Learning for Unlabeled Data

Tzu-Hsuan Chou, Chun-Nan Chou

机构 * CMoney Technology Corporation(CMoney技术公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 7 pages and one figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17385 2025-11-19 cs.CL 87%

Native Design Bias: Studying the Impact of English Nativeness on Language Model Performance

Manon Reusens, Philipp Borchert, Jochen De Weerdt, Bart Baesens

机构 * Research Centre for Information Systems Engineering (LIRIS), KU Leuven(信息系统工程研究中心(LIRIS),库勒文大学) IESEG School of Management(IESEG管理学院) Department of Decision Analytics and Risk, University of Southampton(决策分析与风险系,南安普顿大学)

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)

Comments Accepted at ICJNLP-AACL (findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13800 2025-11-19 cs.CV cs.AI cs.NA math.NA 83%

Synergizing Multigrid Algorithms with Vision Transformer: A Novel Approach to Enhance the Seismic Foundation Model

Huiwen Wu, Shuo Zhang, Yi Liu, Hongbin Ye

机构 * Research Center for Scientific Data Hub Zhejiang Laboratory(科学数据枢纽研究中心 浙江实验室) State Key Laboratory of Mathematical Sciences (SKLMS)(数学科学国家重点实验室) State Key Laboratory of Scientific and Engineering Computing (LSEC)(科学与工程计算国家重点实验室) Institute of Computational Mathematics and Scientific/Engineering Computing Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing, China(数学系统科学学院,中国科学院,北京,中国) School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学数学科学学院,北京,中国)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15127 2025-11-19 cs.LG 80%

PRIMUS: Pretraining IMU Encoders with Multimodal Self-Supervision

Arnav M. Das, Chi Ian Tang, Fahim Kawsar, Mohammad Malekzadeh

机构 * Nokia Bell Labs Cambridge, UK(诺基亚贝尔实验室(剑桥,英国)) University of Washington, USA(华盛顿大学(美国)) University of Glasgow, UK(格拉斯哥大学(英国))

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

Comments Presented at ICASSP 2025. Also presented under the title "PRIMUS: Pretraining IMU Encoders with Multimodal and Self-Supervised Learning" at NeurIPS 2024 TSALM Workshop (Time Series in the Age of Large Models)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14688 2025-11-19 cs.CL cs.AI 79%

Ground Truth Generation for Multilingual Historical NLP using LLMs

Clovis Gladstone, Zhao Fang, Spencer Dean Stewart

机构 * ARTFL Project, Romance Languages and Literatures, University of Chicago(ARTFL项目, Romance语言与文学系,芝加哥大学) Department of History, University of Chicago(历史系,芝加哥大学) Libraries and School of Information Studies, Purdue University(图书馆与信息科学学院,普渡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 5 tables, 1 figure

Journal ref CHR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22242 2025-11-19 cs.CV 78%

4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration

Jiahui Zhang, Yurui Chen, Yueming Xu, Ze Huang, Yanpeng Zhou, Yu-Jie Yuan, Xinyue Cai, Guowei Huang, Xingyue Quan, Hang Xu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14761 2025-11-19 cs.CV cs.AI cs.LG 73%

ARC Is a Vision Problem!

Keya Hu, Ali Cy, Linlu Qiu, Xiaoman Delores Ding, Runqian Wang, Yeyin Eva Zhu, Jacob Andreas, Kaiming He

机构 * MIT(麻省理工学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Technical Report. Project webpage: https://github.com/lillian039/VARC

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05501 2025-11-19 cs.CV 67%

SMOL-MapSeg: Show Me One Label as prompt

Yunshuang Yuan, Frank Thiemann, Thorsten Dahms, Monika Sester

机构 * IKG

专题命中 预训练与数据 :foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14098 2025-11-19 cs.AI cs.MA cs.SI cs.SY eess.SY 57%

Collaborative QA using Interacting LLMs. Impact of Network Structure, Node Capability and Distributed Data

Adit Jain, Vikram Krishnamurthy, Yiming Zhang

机构 * Department of Electrical and Computer Engineering, Cornell University(电气与计算机工程系,康奈尔大学)

专题命中 预训练与数据 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 12 篇

2511.14423 2025-11-19 cs.CL 88%

Unified Defense for Large Language Models against Jailbreak and Fine-Tuning Attacks in Education

Xin Yi, Yue Li, Dongsheng Shi, Linlin Wang, Xiaoling Wang, Liang He

机构 * Shanghai Institute of Artificial Intelligence for Education, East China Normal University, Shanghai 200062, China(教育人工智能研究所,华东师范大学,上海200062,中国) School of Computer Science and Technology, East China Normal University, Shanghai 200062, China(计算机科学与技术学院,华东师范大学,上海200062,中国) School of Computer Science(计算机科学学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14661 2025-11-19 cs.HC 87%

M-CALLM: Multi-level Context Aware LLM Framework for Group Interaction Prediction

Diana Romero, Xin Gao, Daniel Khalkhali, Salma Elmalaki

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01476 2025-11-19 cs.CL cs.AI 86%

Do Retrieval Augmented Language Models Know When They Don't Know?

Youchao Zhou, Heyan Huang, Yicheng Liu, Rui Dai, Xinglin Wang, Xingchen Zhang, Shumin Shi, Yang Deng

机构 * SMU(南密西西比大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments AAAI 2026 camera ready version. Extended version with Appendix is coming soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16029 2025-11-19 cs.CL cs.AI cs.LG 85%

EvoLM: In Search of Lost Language Model Training Dynamics

Zhenting Qi, Fan Nie, Alexandre Alahi, James Zou, Himabindu Lakkaraju, Yilun Du, Eric Xing, Sham Kakade, Hanlin Zhang

机构 * Harvard(哈佛大学) Stanford(斯坦福大学) EPFL(苏黎世联邦理工学院) CMU(卡内基梅隆大学)

专题命中 指令微调 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07991 2025-11-19 cs.AI 83%

VSPO: Validating Semantic Pitfalls in Ontology via LLM-Based CQ Generation

Hyojun Choi, Seokju Hwang, Kyong-Ho Lee

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at AAAI 2026 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13761 2025-11-19 cs.DC cs.AI cs.LG 82%

What happens when nanochat meets DiLoCo?

Alexander Acker, Soeren Becker, Sasho Nedelkoski, Dominik Scheinert, Odej Kao, Philipp Wiesner

机构 * Team exalsius(exalsius团队) Technische Universität Berlin(柏林技术大学)

专题命中 指令微调 :LLM(abstract);pretraining(abstract);post-training(abstract);SFT(abstract)

Comments 8pages, 3 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14027 2025-11-19 cs.CL 81%

HiEAG: Evidence-Augmented Generation for Out-of-Context Misinformation Detection

Junjie Wu, Yumeng Fu, Nan Yu, Guohong Fu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Institute of Artificial Intelligence, Soochow University(苏州大学人工智能研究院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14238 2025-11-19 cs.CV cs.LG 79%

Enhancing Generalization of Depth Estimation Foundation Model via Weakly-Supervised Adaptation with Regularization

Yan Huang, Yongyi Su, Xin Lin, Le Zhang, Xun Xu

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14307 2025-11-19 cs.SD cs.LG 70%

Audio Question Answering with GRPO-Based Fine-Tuning and Calibrated Segment-Level Predictions

Marcel Gibier, Nolwenn Celton, Raphaël Duroselle, Pierre Serrano, Olivier Boeffard, Jean-François Bonastre

机构 * Inria Paris, LR2(巴黎Inria)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Submission to Track 5 of the DCASE 2025 Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05026 2025-11-19 cs.CL cs.HC 70%

Deep Learning and Machine Learning -- Natural Language Processing: From Theory to Application

Keyu Chen, Cheng Fei, Ziqian Bi, Junyu Liu, Benji Peng, Sen Zhang, Xuanhe Pan, Jiawei Xu, Jinlang Wang, Caitlyn Heqi Yin, Yichao Zhang, Pohsun Feng, Yizhu Wen, Tianyang Wang, Ming Li, Jintao Ren, Qian Niu, Silin Chen, Weiche Hsieh, Lawrence K. Q. Yan, Chia Xin Liang, Han Xu, Hong-Ming Tseng, Xinyuan Song, Zekun Jiang, Ming Liu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 252 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13234 2025-11-19 cs.LG cs.AI 62%

Non-Uniform Class-Wise Coreset Selection for Vision Model Fine-tuning

Hanyu Zhang, Zhen Xing, Ruian He, Wenxuan Yang, Chenxi Ma, Weimin Tan, Bo Yan

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

Comments 13pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10683 2025-11-19 cs.RO cs.AI cs.CV 57%

MotIF: Motion Instruction Fine-tuning

Minyoung Hwang, Joey Hejna, Dorsa Sadigh, Yonatan Bisk

机构 * Massachusetts Institute of Technology(麻省理工学院) Stanford University(斯坦福大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 9 篇

2511.13765 2025-11-19 cs.LG cs.AI 88%

PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning

Shengjie Sun, Jiafei Lyu, Runze Liu, Mengbei Yan, Bo Liu, Deheng Ye, Xiu Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

专题命中 后训练与偏好优化 :LLM(title);preference optimization(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23229 2025-11-19 cs.CL cs.AI cs.CY 79%

MCTSr-Zero: Self-Reflective Psychological Counseling Dialogues Generation via Principles and Adaptive Exploration

Hao Lu, Yanchi Gu, Haoyuan Huang, Yulin Zhou, Ningxin Zhu, Chen Li

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 48 pages, 3 figures. Accepted in AAAI-2026 (Main Technical Track). For code and model, see this https://github.com/JianChengXingYun/Mctsr-Zero

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13288 2025-11-19 cs.AI 77%

Multi-Agent Deep Research: Training Multi-Agent Systems with M-GRPO

Haoyang Hong, Jiajun Yin, Yuan Wang, Jingnan Liu, Zhe Chen, Ailing Yu, Ji Li, Zhiling Ye, Hansong Xiao, Yefei Chen, Hualei Zhou, Yun Yue, Minghui Yang, Chunxiao Guo, Junwei Liu, Peng Wei, Jinjie Gu

机构 * Ant Group(蚂蚁集团) Imperial College London(伦敦帝国理工学院)

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13787 2025-11-19 cs.LG cs.AI 73%

Preference Learning with Lie Detectors can Induce Honesty or Evasion

Chris Cundy, Adam Gleave

专题命中 后训练与偏好优化 :LLM(abstract);post-training(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14659 2025-11-19 cs.RO cs.AI 70%

NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards

Chia-Yu Hung, Navonil Majumder, Haoyuan Deng, Liu Renhang, Yankang Ang, Amir Zadeh, Chuan Li, Dorien Herremans, Ziwei Wang, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Lambda Labs(Lambda实验室) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 后训练与偏好优化 :post-training(abstract);preference optimization(abstract);分类 cs.AI

Comments https://declare-lab.github.io/nora-1.5

详情

展开后加载摘要…

URL PDF HTML 收藏