arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-01 至 2025-10-01 共收录 274 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 16 篇

2509.25494 2025-10-01 cs.IR 89%

On-Premise AI for the Newsroom: Evaluating Small Language Models for Investigative Document Search

Nick Hagar, Nicholas Diakopoulos, Jeremy Gilbert

专题命中 预训练与数据 :language model(title,abstract);small language model(title);LLM(abstract);large language model(abstract)

Comments Accepted to Computation + Journalism Symposium 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14688 2025-10-01 cs.CL cs.AI cs.LG 88%

Mind the Gap: A Review of Arabic Post-Training Datasets and Their Limitations

Mohammed Alkhowaiter, Norah Alshahrani, Saied Alshahrani, Reem I. Masoud, Alaa Alzahrani, Deema Alnuhait, Emad A. Alghamdi, Khalid Almubarak

机构 * Refine AI ASAS AI University of Bisha(比沙大学) University College London(伦敦大学学院) King Salman Global Academy for Arabic(萨勒曼全球阿拉伯学院) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) King Abdulaziz University(阿卜杜勒阿齐兹大学) HUMAIN

专题命中 预训练与数据 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25283 2025-10-01 cs.CY cs.AI cs.HC 86%

Effectiveness of Large Language Models in Simulating Regional Psychological Structures: An Empirical Examination of Personality and Subjective Well-being

Ke Luoma, Li Zengyi, Liao Jiangqun, Tong Song, Peng Kaiping

专题命中 预训练与数据 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25850 2025-10-01 cs.LG 85%

RL-Guided Data Selection for Language Model Finetuning

Animesh Jha, Harshit Gupta, Ananjan Nandi

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.LG

Comments To appear in NeurIPS 2025 Constrained Optimization for ML Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25498 2025-10-01 cs.CL cs.AI 84%

Not Wrong, But Untrue: LLM Overconfidence in Document-Based Queries

Nick Hagar, Wilma Agustianto, Nicholas Diakopoulos

机构 * Northwestern University(西北大学) University of Minnesota(明尼苏达大学)

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to Computation + Journalism Symposium 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21611 2025-10-01 cs.CL cs.AI cs.LG 83%

When Does Multimodality Lead to Better Time Series Forecasting?

Xiyuan Zhang, Boran Han, Haoyang Fang, Abdul Fatir Ansari, Shuai Zhang, Danielle C. Maddix, Cuixiong Hu, Andrew Gordon Wilson, Michael W. Mahoney, Hao Wang, Yan Liu, Huzefa Rangwala, George Karypis, Bernie Wang

机构 * Amazon Web Services(亚马逊网络服务)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26016 2025-10-01 cs.CV 82%

GeoLink: Empowering Remote Sensing Foundation Model with OpenStreetMap Data

Lubian Bai, Xiuyuan Zhang, Siqi Zhang, Zepeng Zhang, Haoyu Wang, Wei Qin, Shihong Du

机构 * School of Earth and Space Sciences, Peking University(地球与空间科学学院,北京大学) College of Urban and Environmental Sciences, Peking University(城市与环境科学学院,北京大学) State Key Laboratory of Multimodal Artificial Intelligence Systems Institute of Automation, CAS(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) Intelligent Maintenance and Operations Systems Lab(智能维护与运营系统实验室)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25788 2025-10-01 cs.LG 79%

From Cheap Geometry to Expensive Physics: Elevating Neural Operators via Latent Shape Pretraining

Zhizhou Zhang, Youjia Wu, Kaixuan Zhang, Yanjia Wang

机构 * Corporate Research Bosch (China) Investment Co., Ltd.(博世(中国)投资有限公司)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26507 2025-10-01 cs.NE cs.AI cs.LG stat.ML 73%

The Dragon Hatchling: The Missing Link between the Transformer and Models of the Brain

Adrian Kosowski, Przemysław Uznański, Jan Chorowski, Zuzanna Stamirowska, Michał Bartoszkiewicz

机构 * Pathway

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Code available at: https://github.com/pathwaycom/bdh Accompanying blog: https://pathway.com/research/bdh

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25649 2025-10-01 cs.CL 70%

The Media Bias Detector: A Framework for Annotating and Analyzing the News at Scale

Samar Haider, Amir Tohidi, Jenny S. Wang, Timothy Dörr, David M. Rothschild, Chris Callison-Burch, Duncan J. Watts

机构 * Department of Computer and Information Science, University of Pennsylvania(计算机与信息科学系,宾夕法尼亚大学) Harvard Business School(哈佛商学院) Microsoft Research(微软研究院) Annenberg School for Communication, University of Pennsylvania(传播学院,宾夕法尼亚大学) Department of Operations, Information, and Decisions, University of Pennsylvania(运营、信息与决策系,宾夕法尼亚大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26551 2025-10-01 stat.ML cs.LG 57%

Pretrain-Test Task Alignment Governs Generalization in In-Context Learning

Mary I. Letey, Jacob A. Zavatone-Veth, Yue M. Lu, Cengiz Pehlevan

机构 * John A. Paulson School of Engineering and Applied Sciences, Harvard University, Cambridge, MA, USA(哈佛大学约翰·A·保罗森工程与应用科学学院) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University, Cambridge, MA, USA(哈佛大学自然与人工智能研究 institute) Society of Fellows, Harvard University, Cambridge, MA, USA(哈佛大学 fellows 社会) Center for Brain Science, Harvard University, Cambridge, MA, USA(哈佛大学脑科学中心)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26397 2025-10-01 physics.chem-ph cs.LG physics.comp-ph 57%

Are neural scaling laws leading quantum chemistry astray?

Siwoo Lee, Adji Bousso Dieng

专题命中 预训练与数据 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25964 2025-10-01 cs.LG 57%

Reevaluating Convolutional Neural Networks for Spectral Analysis: A Focus on Raman Spectroscopy

Deniz Soysal, Xabier García-Andrade, Laura E. Rodriguez, Pablo Sobron, Laura M. Barge, Renaud Detry

机构 * Lunar \& Planetary Institute, Universities Space Research Association, 3600 Bay Area Boulevard, Houston, TX 77058, USA Jet Propulsion Laboratory, California Institute of Technology, 4800 Oak Grove Drive, La Cañada Flintridge, CA 91011, USA KU Leuven, Dept.\ Electrical Engineering, Research Unit Processing Speech

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Journal ref ACS Earth and Space Chemistry, 2025, ASAP

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17771 2025-10-01 cs.CL 57%

Speculating LLMs' Chinese Training Data Pollution from Their Tokens

Qingjie Zhang, Di Wang, Haoting Qian, Liu Yan, Tianwei Zhang, Ke Xu, Qi Li, Minlie Huang, Hewu Li, Han Qiu

机构 * Tsinghua University(清华大学) Ant Group(蚂蚁集团) Nanyang Technological University(南洋理工大学) Zhongguancun Laboratory(中关村实验室)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06756 2025-10-01 cs.CV cs.AI 57%

FoundBioNet: A Foundation-Based Model for IDH Genotyping of Glioma from Multi-Parametric MRI

Somayeh Farahani, Marjaneh Hejazi, Antonio Di Ieva, Sidong Liu

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

Comments Accepted for oral and poster presentation at MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09253 2025-10-01 quant-ph 50%

The generative quantum eigensolver (GQE) and its application for ground state search

Kouhei Nakaji, Lasse Bjørn Kristensen, Ryota Kemmoku, Jorge A. Campos-Gonzalez-Angulo, Mohammad Ghazi Vakili, Haozhe Huang, Mohsen Bagherimehrab, Christoph Gorgulla, FuTe Wong, Alex McCaskey, Jin-Sung Kim, Thien Nguyen, Pooja Rao, Qi Gao, Michihiko Sugawara, Naoki Yamamoto, Alán Aspuru-Guzik

专题命中 预训练与数据 :pretraining(abstract)

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 20 篇

2509.26584 2025-10-01 cs.AI cs.IR cs.LG cs.SE 90%

Fairness Testing in Retrieval-Augmented Generation: How Small Perturbations Reveal Bias in Small Language Models

Matheus Vinicius da Silva de Oliveira, Jonathan de Andrade Silva, Awdren de Lima Fontao

机构 * Faculty of Computing - Federal University of Mato Grosso do Sul(计算机学院 - 短暂戈亚那联邦大学)

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11027 2025-10-01 cs.CL cs.AI 90%

BianCang: A Traditional Chinese Medicine Large Language Model

Sibo Wei, Xueping Peng, Yi-Fei Wang, Tao Shen, Jiasheng Si, Weiyu Zhang, Fa Zhu, Athanasios V. Vasilakos, Wenpeng Lu, Xiaoming Wu, Yinglong Wang

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences), and with Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science(计算机功率网络与信息安全重点实验室,教育部,山东计算机科学中心(国家超级计算机中心济南中心),齐鲁工业大学(山东科学院),并与山东省计算功率互联网与服务计算省级重点实验室,山东省计算机科学基础研究中心) Australian Artificial Intelligence Institute, University of Technology Sydney(澳大利亚人工智能研究所,技术悉尼大学) Affiliated Hospital of Shandong University of Traditional Chinese Medicine(山东中医药大学附属医院) College of Information Science and Technology & Artificial Intelligence, Nanjing Forestry University(信息科学与技术及人工智能学院,南京林业大学) Department of ICT and Center for AI Research, University of Agder (UiA)(ICT系和人工智能研究中心,阿格德大学(UiA))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Journal ref IEEE Journal of Biomedical and Health Informatics (Early Access), 2025, 1-12

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25241 2025-10-01 cs.LG cs.CR 89%

Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge

Yuan Huang

机构 * Shenzhen College of International Education(深圳国际教育学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26625 2025-10-01 cs.LG cs.AI cs.CV cs.MM 88%

Learning to See Before Seeing: Demystifying LLM Visual Priors from Language Pre-training

Junlin Han, Shengbang Tong, David Fan, Yufan Ren, Koustuv Sinha, Philip Torr, Filippos Kokkinos

机构 * Meta Superintelligence Labs(Meta 超智能实验室) University of Oxford(牛津大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Project page: https://junlinhan.github.io/projects/lsbs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12299 2025-10-01 cs.CR cs.AI 87%

QGuard:Question-based Zero-shot Guard for Multi-modal LLM Safety

Taegyeong Lee, Jeonghwa Yoo, Hyoungseo Cho, Soo Yong Kim, Yunho Maeng

机构 * FnGuide Inc.(FnGuide公司) Safe Generative AI Lab, MODULABS(MODULABS安全生成AI实验室) A.I.MATICS Inc.(A.I.MATICS公司) Ewha Womans University(成均馆大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accept to ACLW 2025 (WOAH); fix typo

Journal ref ACL Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05021 2025-10-01 cs.CL cs.CR 87%

Safety is Not Only About Refusal: Reasoning-Enhanced Fine-tuning for Interpretable LLM Safety

Yuyou Zhang, Miao Li, William Han, Yihang Yao, Zhepeng Cen, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07760 2025-10-01 cs.CR cs.LG 86%

Scalable Fingerprinting of Large Language Models

Anshul Nasery, Jonathan Hayase, Creston Brooks, Peiyao Sheng, Himanshu Tyagi, Pramod Viswanath, Sewoong Oh

机构 * University of Washington(华盛顿大学) Sentient

专题命中 指令微调 :large language model(title);language model(title);post-training(abstract);分类 cs.LG

Comments Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02296 2025-10-01 cs.AI 85%

Memorize or Generalize? Evaluating LLM Code Generation with Code Rewriting

Lizhe Zhang, Wentao Chen, Li Zhong, Letian Peng, Zilong Wang, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24361 2025-10-01 cs.CV cs.AI cs.HC 84%

UI-UG: A Unified MLLM for UI Understanding and Generation

Hao Yang, Weijie Qiu, Ru Zhang, Zhou Fang, Ruichao Mao, Xiaoyu Lin, Maji Huang, Zhaosong Huang, Teng Guo, Shuoyang Liu, Hai Rao

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26598 2025-10-01 cs.CR cs.AI cs.LG 81%

Are Robust LLM Fingerprints Adversarially Robust?

Anshul Nasery, Edoardo Contente, Alkin Kaz, Pramod Viswanath, Sewoong Oh

机构 * University of Washington(华盛顿大学) Princeton University(普林斯顿大学) Sentient

专题命中 指令微调 :LLM(title);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25274 2025-10-01 q-bio.GN cs.AI cs.LG 81%

DNABERT-2: Fine-Tuning a Genomic Language Model for Colorectal Gene Enhancer Classification

Darren King, Yaser Atlasi, Gholamreza Rafiee

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

Comments 10 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20230 2025-10-01 cs.LG cs.AI 81%

Beyond Sharp Minima: Robust LLM Unlearning via Feedback-Guided Multi-Point Optimization

Wenhan Wu, Zheyuan Liu, Chongyang Gao, Ren Wang, Kaize Ding

机构 * Department of Statistics and Data Science(统计与数据科学系) Northwestern University(西北大学) Department of Computer Science and Engineering(计算机科学与工程系) University of Notre Dame(圣母大学) Department of Computer Science(计算机科学系) Illinois Institute of Technology(伊利诺伊理工学院)

专题命中 指令微调 :LLM(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03006 2025-10-01 cs.SE 80%

A Preference-Driven Methodology for High-Quality Solidity Code Generation

Zhiyuan Peng, Xin Yin, Chenhao Ying, Chao Ni, Yuan Luo

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25193 2025-10-01 cs.SE cs.AI 74%

Devstral: Fine-tuning Language Models for Coding Agent Applications

Abhinav Rastogi, Adam Yang, Albert Q. Jiang, Alexander H. Liu, Alexandre Sablayrolles, Amélie Héliou, Amélie Martin, Anmol Agarwal, Andy Ehrenberg, Andy Lo, Antoine Roux, Arthur Darcet, Arthur Mensch, Baptiste Bout, Baptiste Rozière, Baudouin De Monicault, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clémence Lanfranchi, Clément Denoix, Corentin Barreau, Darius Dabert Devon Mizelle, Diego de las Casas, Elliot Chane-Sane, Emilien Fugier, Emma Bou Hanna, Gabrielle Berrada, Gauthier Delerce, Gauthier Guinet, Georgii Novikov, Graham Neubig, Guillaume Lample, Guillaume Martin, Himanshu Jaju, Jan Ludziejewski, Jason Rute, Jean-Malo Delignon, JeanHadrien Chabran, Joachim Studnia, Joep Barmentlo, Jonas Amar, Josselin Somerville Roberts, Julien Denize, Karan Saxena, Karmesh Yadav, Kartik Khandelwal, Khyathi Raghavi Chandu, Kush Jain, Lélio Renard Lavaud, Léonard Blier, Lingxiao Zhao, Louis Martin, Lucile Saulnier, Luyu Gao, Marie Pellat, Mathilde Guillaumin, Mathis Felardos, Matthieu Dinot, Maxime Darrin, Maximilian Augustin, Mickaël Seznec, Neha Gupta, Nikhil Raghuraman, Olivier Duchenne, Patricia Wang, Patrick von Platen, Patryk Saffer, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Philomène Chagniot, Pierre Stock, Pravesh Agrawal, Rémi Delacourt, Roman Soletskyi, Romain Sauvestre, Sagar Vaze, Sanchit Gandhi, Sandeep Subramanian, Shashwat Dalal, Siddharth Gandhi, Soham Ghosh, Srijan Mishra, Sumukh Aithal, Szymon Antoniak, Teven Le Scao, Thibaut Lavril, Thibault Schueller, Thomas Foubert, Thomas Robert, Thomas Wang, Timothée Lacroix, Tom Bewley, Valeriia Nemychnikova, Victor Paltz, Virgile Richard, Wen-Ding Li, William Marshall, Xingyao Wang, Xuanyu Zhang, Yihan Wan, Yunhao Tang

机构 * Mistral AI

专题命中 指令微调 :language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏