arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-06 至 2025-11-06 共收录 153 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 15 篇

2511.03106 2025-11-06 cs.AI 89%

Large language models require a new form of oversight: capability-based monitoring

Katherine C. Kellogg, Bingyang Ye, Yifan Hu, Guergana K. Savova, Byron Wallace, Danielle S. Bitterman

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07491 2025-11-06 cs.CV 89%

SpatialLM: Training Large Language Models for Structured Indoor Modeling

Yongsen Mao, Junhao Zhong, Chuan Fang, Jia Zheng, Rui Tang, Hao Zhu, Ping Tan, Zihan Zhou

机构 * Manycore Tech Inc.(Manycore科技公司) Hong Kong University of Science and Technology(香港科技大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12563 2025-11-06 cs.CL cs.AI cs.LG 87%

MetaSynth: Meta-Prompting-Driven Agentic Scaffolds for Diverse Synthetic Data Generation

Haris Riaz, Sourav Bhabesh, Vinayak Arannil, Miguel Ballesteros, Graham Horwood

专题命中 预训练与数据 :prompting(title,abstract);LLM(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 33 pages, 17 figures. Findings of ACL 2025

Journal ref Findings of the Association for Computational Linguistics: ACL 2025, pp. 18770-18803, Vienna, Austria, 2025. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03570 2025-11-06 cs.LG 86%

TabGemma: Text-Based Tabular ICL via LLM using Continued Pretraining and Retrieval

Günther Schindler, Maximilian Schambach, Michael Medek, Sam Thelin

机构 * SAP SE(SAP公司)

专题命中 预训练与数据 :pretraining(title,abstract);LLM(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03251 2025-11-06 cs.LG cs.AI cs.SI 84%

GMoPE:A Prompt-Expert Mixture Framework for Graph Foundation Models

Zhibin Wang, Zhixing Zhang, Shuqi Wang, Xuanting Xie, Zhao Kang

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03280 2025-11-06 cs.LG cs.AI cs.CL 82%

Training Optimal Large Diffusion Language Models

Jinjie Ni, Qian Liu, Chao Du, Longxu Dou, Hang Yan, Zili Wang, Tianyu Pang, Michael Qizhe Shieh

机构 * National University of Singapore(新加坡国立大学) Sea AI Lab(Sea AI 实验室) StepFun Shanghai Qiji Zhifeng Co Ltd(上海启智丰有限公司)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21422 2025-11-06 cs.CE 82%

ChemFM as a Scaling Law Guided Foundation Model Pre-trained on Informative Chemicals

Feiyang Cai, Katelin Zacour, Tianyu Zhu, Tzuen-Rong Tzeng, Yongping Duan, Ling Liu, Srikanth Pilla, Gang Li, Feng Luo

专题命中 预训练与数据 :foundation model(title,abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14766 2025-11-06 cs.LG cs.AI 81%

This Time is Different: An Observability Perspective on Time Series Foundation Models

Ben Cohen, Emaad Khwaja, Youssef Doubli, Salahidine Lemaachi, Chris Lettieri, Charles Masson, Hugo Miccinilli, Elise Ramé, Qiqi Ren, Afshin Rostamizadeh, Jean Ogier du Terrail, Anna-Monica Toon, Kan Wang, Stephan Xie, Zongzhe Xu, Viktoriya Zhukova, David Asker, Ameet Talwalkar, Othmane Abou-Amal

机构 * Datadog AI Research(Datadog AI研究中心) Carnegie Mellon University(卡内基梅隆大学)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03276 2025-11-06 cs.LG 79%

Diffusion Language Models are Super Data Learners

Jinjie Ni, Qian Liu, Longxu Dou, Chao Du, Zili Wang, Hang Yan, Tianyu Pang, Michael Qizhe Shieh

机构 * National University of Singapore(新加坡国立大学) Sea AI Lab(Sea AI实验室) StepFun Shanghai Qiji Zhifeng Co Ltd(上海启峰科技有限公司)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03019 2025-11-06 cs.CV cs.AI 79%

SLIP: Structural-aware Language-Image Pretraining for Vision-Language Alignment

Wenbo Lu

机构 * Department of Data Science(数据科学系) New York University Shanghai(纽约大学上海分校)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

Comments Capstone Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02853 2025-11-06 cs.CL 70%

Modeling Annotator Disagreement with Demographic-Aware Experts and Synthetic Perspectives

Yinuo Xu, Veronica Derricks, Allison Earl, David Jurgens

机构 * University of Michigan(密歇根大学) University of Colorado Boulder(科罗拉多大学波德穆尔分校)

专题命中 预训练与数据 :LLM(abstract);prompting(abstract);分类 cs.CL

Comments 8 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03371 2025-11-06 cond-mat.mtrl-sci physics.comp-ph 67%

Enhancing composition-based materials property prediction by cross-modal knowledge transfer

Ivan Rubtsov, Ivan Dudakov, Yuri Kuratov, Vadim Korolev

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments 7 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16495 2025-11-06 cs.CV 67%

ALTo: Adaptive-Length Tokenizer for Autoregressive Mask Generation

Lingfeng Wang, Hualing Lin, Senda Chen, Tao Wang, Changxu Cheng, Yangyang Zhong, Dong Zheng, Wuyue Zhao

机构 * Uni-Ubi Zhejiang University(浙江大学) Tongji University(同济大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03492 2025-11-06 cs.LG stat.ML 57%

Why Less is More (Sometimes): A Theory of Data Curation

Elvis Dohmatob, Mohammad Pezeshki, Reyhane Askari-Hemmat

机构 * Concordia University(康科德大学) FAIR at Meta(Meta的FAIR) Mila--Quebec AI Institute(魁北克AI研究所)

专题命中 预训练与数据 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11772 2025-11-06 cs.CV cs.LG 57%

CLIP Meets Diffusion: A Synergistic Approach to Anomaly Detection

Byeongchan Lee, John Won, Seunghyun Lee, Jinwoo Shin

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国先进科学技术研究院)

专题命中 预训练与数据 :foundation model(abstract);分类 cs.LG

Comments Accepted at TMLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 14 篇

2503.07329 2025-11-06 cs.CL cs.AI cs.LG 89%

Assessing the Macro and Micro Effects of Random Seeds on Fine-Tuning Large Language Models

Nghia Bui, Guergana Savova, Lijing Wang

机构 * New Jersey Institute of Technology(新泽西理工学院) Boston Children’s Hospital and Harvard Medical School(波士顿儿童医院和哈佛医学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 5 tables, 3 figures. Accepted at IJCNLP 2025. This is the final, peer-reviewed version of the work, which supersedes and extends the unauthorized draft previously posted as arXiv:2503.07329

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03466 2025-11-06 cs.CL 88%

Kastor: Fine-tuned Small Language Models for Shape-based Active Relation Extraction

Ringwald Celian, Gandon Fabien, Faron Catherine, Michel Franck, Abi Akl Hanna

机构 * Université Côte d’Azur(蔚蓝海岸大学) Inria(法国国家信息与自动化技术研究所) CNRS(法国国家科学研究中心) I3S(信息科学与系统研究所) Data ScienceTech Institute(数据科学技术研究所)

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);分类 cs.CL

Comments Accepted at ESWC 2025

Journal ref The Semantic Web: 22nd European Semantic Web Conference, ESWC 2025, Portoroz, Slovenia, June 1 5, 2025, Proceedings, Part I

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02869 2025-11-06 cs.SE cs.AI cs.PL 88%

Analysis of AdvFusion: Adapter-based Multilingual Learning for Code Large Language Models

Amirreza Esmaeili, Fahd Seddik, Yongyi Ji, Fatemeh Fard, Fuxiang Chen

机构 * University of British Columbia(不列颠哥伦比亚大学) University of Leicester(利兹大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03149 2025-11-06 cs.LG cs.AI 81%

Forecast2Anomaly (F2A): Adapting Multivariate Time Series Foundation Models for Anomaly Prediction

Atif Hassan, Tarun Kumar, Ashish Mishra, Sergey Serebryakov, Satish Kumar Mopur, Phanidhar Koganti, Murthy Chelankuri, Ramanagopal Vogety, Suparna Bhattacharya, Martin Foltin

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03128 2025-11-06 cs.LG cs.CL 81%

From Insight to Exploit: Leveraging LLM Collaboration for Adaptive Adversarial Text Generation

Najrin Sultana, Md Rafi Ur Rashid, Kang Gu, Shagufta Mehnaz

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Dartmouth College(达特茅斯学院)

专题命中 指令微调 :LLM(title,abstract);分类 cs.CL、cs.LG

Comments Findings of the Association for Computational Linguistics: EMNLP 2025 (camera-ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09707 2025-11-06 cs.LG cs.AI cs.CV 81%

Revisiting semi-supervised learning in the era of foundation models

Ping Zhang, Zheda Mai, Quang-Huy Nguyen, Wei-Lun Chao

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments The paper has been accepted to NeurIPS 2025. Ping Zhang and Zheda Mai contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03410 2025-11-06 cs.CL 77%

Knowledge-Augmented Question Error Correction for Chinese Question Answer System with QuestionRAG

Longpeng Qiu, Ting Li, Shuai Mao, Nan Yang, Xiaohui Yan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments EMNLP2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03376 2025-11-06 eess.IV cs.AI q-bio.QM 77%

Computational Imaging Meets LLMs: Zero-Shot IDH Mutation Prediction in Brain Gliomas

Syed Muqeem Mahmood, Hassan Mohy-ud-Din

机构 * School of Science and Engineering, Lahore University of Management Sciences, Lahore, Pakistan(科学与工程学院,拉合尔管理科学大学,巴基斯坦拉合尔)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02625 2025-11-06 cs.LG 77%

HALO: Hadamard-Assisted Lower-Precision Optimization for LLMs

Saleh Ashkboos, Mahdi Nikdan, Soroush Tabesh, Roberto L. Castro, Torsten Hoefler, Dan Alistarh

机构 * ETH Zurich(苏黎世联邦理工学院) ISTAustria(奥地利科学院) Neural Magic

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03247 2025-11-06 cs.CR cs.LG 70%

Death by a Thousand Prompts: Open Model Vulnerability Analysis

Amy Chang, Nicholas Conley, Harish Santhanalakshmi Ganesan, Adam Swanda

机构 * Cisco AI Threat Research & Security(思科AI威胁研究与安全)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02886 2025-11-06 cs.LG cs.AI 62%

Test-time Adaptation of Tiny Recursive Models

Ronan Killian McGovern

机构 * Trelis LTD(Trelis有限公司)

专题命中 指令微调 :post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01755 2025-11-06 cs.LG cs.AI 62%

Robust Federated Finetuning of LLMs via Alternating Optimization of LoRA

Shuangyi Chen, Yuanxin Guo, Yue Ju, Harik Dalal, Zhongwen Zhu, Ashish Khisti

机构 * University of Toronto(多伦多大学) Ericsson-GAIA Montréal(爱立信-GAIA蒙特利尔)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2025

Journal ref https://openreview.net/forum?id=e8DrPuJekZ&referrer=%5BAuthor%20Console%5D(%2Fgroup%3Fid%3DNeurIPS.cc%2F2025%2FConference%2FAuthors%23your-submissions)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03611 2025-11-06 astro-ph.SR physics.comp-ph physics.flu-dyn 50%

Modelling the Solar Cycle Nonlinearities into the Algebraic Approach

Mohammed H. Talafha

专题命中 指令微调 :SFT(abstract)

Comments 22 pages, 10 figures; Solar Physics Journal, Accepted: 29 October 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03459 2025-11-06 cs.CV 50%

Generalizing Shape-from-Template to Topological Changes

Kevin Manogue, Tomasz M Schang, Dilara Kuş, Jonas Müller, Stefan Zachow, Agniva Sengupta

专题命中 指令微调 :SFT(abstract)

Comments Accepted for publication at Smart Tools and Applications in Graphics (STAG), Genoa, Italy (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 3 篇

2412.16378 2025-11-06 cs.LG cs.AI cs.CL 82%

REFA: Reference Free Alignment for multi-preference optimization

Taneesh Gupta, Rahul Madhavan, Xuchao Zhang, Chetan Bansal, Saravan Rajmohan

机构 * MicrosoftIndian Institute of Science (IISc), Bangalore(微软印度科学研究院(IISc),班加罗尔)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏