arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-17 至 2025-11-17 共收录 186 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 8 篇

2508.03589 2025-11-17 cs.LG 79%

VITA: Variational Pretraining of Transformers for Climate-Robust Crop Yield Forecasting

Adib Hasan, Mardavij Roozbehani, Munther Dahleh

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10829 2025-11-17 cs.LG 74%

Towards Universal Neural Operators through Multiphysics Pretraining

Mikhail Masliaev, Dmitry Gusarov, Ilya Markov, Alexander Hvatov

机构 * ITMO University(ITMO大学)

专题命中 预训练与数据 :pretraining(title);分类 cs.LG

Comments 5 pages, 1 figure, accepted for Machine Learning and the Physical Sciences Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04668 2025-11-17 cs.CV 67%

SIMS-V: Simulated Instruction-Tuning for Spatial Video Understanding

Ellis Brown, Arijit Ray, Ranjay Krishna, Ross Girshick, Rob Fergus, Saining Xie

机构 * New York University(纽约大学) Boston University(波士顿大学) AllenAI Vercept

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments Project page: https://ellisbrown.github.io/sims-v

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08544 2025-11-17 cs.LG cs.AI cs.CV stat.ML 62%

LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics

Randall Balestriero, Yann LeCun

机构 * Brown University(布朗大学) New York University (NYU)(纽约大学) Meta-FAIR

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09923 2025-11-17 cs.LG cs.AI cs.RO 62%

Harnessing Bounded-Support Evolution Strategies for Policy Refinement

Ethan Hirschowitz, Fabio Ramos

机构 * The University of Sydney(悉尼大学) NVIDIA(NVIDIA公司)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 6 figures, to be published in Australasian Conference on Robotics and Automation (ACRA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10590 2025-11-17 cs.LG 57%

Pretrained Joint Predictions for Scalable Batch Bayesian Optimization of Molecular Designs

Miles Wang-Henderson, Benjamin Kaufman, Edward Williams, Ryan Pederson, Matteo Rossi, Owen Howell, Carl Underkoffler, Narbe Mardirossian, John Parkhill

专题命中 预训练与数据 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08716 2025-11-17 cs.CL 57%

ModernBERT or DeBERTaV3? Examining Architecture and Data Influence on Transformer Encoder Models Performance

Wissam Antoun, Benoît Sagot, Djamé Seddah

机构 * Inria(法国国家信息与自动化技术研究院)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL

Comments Published as a conference paper at IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10896 2025-11-17 eess.IV cs.AI cs.CV 57%

CLIPPan: Adapting CLIP as A Supervisor for Unsupervised Pansharpening

Lihua Jian, Jiabo Liu, Shaowu Wu, Lihui Chen

专题命中 预训练与数据 :language model(abstract);分类 cs.AI

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 15 篇

2511.10628 2025-11-17 cs.CL cs.AI cs.LG 87%

Instella: Fully Open Language Models with Stellar Performance

Jiang Liu, Jialian Wu, Xiaodong Yu, Yusheng Su, Prakamya Mishra, Gowtham Ramesh, Sudhanshu Ranjan, Chaitanya Manem, Ximeng Sun, Ze Wang, Pratik Prabhanjan Brahma, Zicheng Liu, Emad Barsoum

机构 * AMD

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11250 2025-11-17 cs.CR 85%

Prompt Engineering vs. Fine-Tuning for LLM-Based Vulnerability Detection in Solana and Algorand Smart Contracts

Biagio Boi, Christian Esposito

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16270 2025-11-17 cs.CL cs.AI cs.LG 85%

Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuning

Jiaru Zou, Yikun Ban, Zihao Li, Yunzhe Qi, Ruizhong Qiu, Ling Yang, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Princeton University(普林斯顿大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10686 2025-11-17 cs.CL 84%

A methodological analysis of prompt perturbations and their effect on attack success rates

Tiago Machado, Maysa Malfiza Garcia de Macedo, Rogerio Abreu de Paula, Marcelo Carpinette Grave, Aminat Adebiyi, Luan Soares de Souza, Enrico Santarelli, Claudio Pinhanez

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14626 2025-11-17 cs.CL cs.AI 82%

LDC: Learning to Generate Research Idea with Dynamic Control

Ruochen Li, Liqiang Jing, Chi Han, Jiawei Zhou, Xinya Du

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) UIUC(伊利诺伊大学香槟分校) Stony Brook University(史泰森布鲁克大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14561 2025-11-17 cs.CL cs.DL 81%

Can LLMs Predict Citation Intent? An Experimental Analysis of In-context Learning and Fine-tuning on Open LLMs

Paris Koloveas, Serafeim Chatzopoulos, Thanasis Vergoulis, Christos Tryfonopoulos

机构 * IMSI, ATHENA RC(IMSI,ATHENA RC) University of the Peloponnese(皮埃蒙特大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted for publication on TPDL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12684 2025-11-17 cs.LG cs.AI cs.DB cs.SI 81%

Towards Effective Federated Graph Foundation Model via Mitigating Knowledge Entanglement

Yinlin Zhu, Xunkai Li, Jishuo Jia, Miao Hu, Di Wu, Meikang Qiu

机构 * Sun Yat-sen University(中山大学) Beijing Institute of Technology(北京理工大学) Shandong University(山东大学) Augusta University(奥古斯塔大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04243 2025-11-17 cs.CV cs.LG eess.IV 79%

Quantifying the Limits of Segmentation Foundation Models: Modeling Challenges in Segmenting Tree-Like and Low-Contrast Objects

Yixin Zhang, Nicholas Konz, Kevin Kramer, Maciej A. Mazurowski

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Computer Science(计算机科学系) Department of Radiology(放射学系) Department of Biostatistics & Bioinformatics(生物统计学与生物信息学系) Minnesota Health Solutions(明尼苏达健康解决方案)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments Accepted at WACV 2026. Code: https://github.com/mazurowski-lab/SAMFailureMetrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11066 2025-11-17 cs.CV cs.AI cs.CL 79%

S2D-ALIGN: Shallow-to-Deep Auxiliary Learning for Anatomically-Grounded Radiology Report Generation

Jiechao Gao, Chang Liu, Yuangang Li

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10671 2025-11-17 cs.CL cs.CV 77%

Grounded Visual Factualization: Factual Anchor-Based Finetuning for Enhancing MLLM Factual Consistency

Filippo Morbiato, Luca Romano, Alessandro Persona

机构 * University of Padua(帕多瓦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11119 2025-11-17 cs.CV 75%

Stroke Modeling Enables Vectorized Character Generation with Large Vectorized Glyph Model

Xinyue Zhang, Haolong Li, Jiawei Ma, Chen Ye

机构 * Tongji University(同济大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01812 2025-11-17 cs.CL cs.AI cs.LG 75%

$\textit{New News}$: System-2 Fine-tuning for Robust Integration of New Knowledge

Core Francisco Park, Zechen Zhang, Hidenori Tanaka

机构 * Harvard University(哈佛大学) CBS-NTT Program in Physics of Intelligence(物理智能CBS-NTT项目) Center for Brain Science(脑科学中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11880 2025-11-17 cs.LG cs.AI cs.CL 75%

FedALT: Federated Fine-Tuning through Adaptive Local Training with Rest-of-World LoRA

Jieming Bian, Lei Wang, Letian Zhang, Jie Xu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00108 2025-11-17 cs.LG cs.AI cs.RO 62%

Pelican-VL 1.0: A Foundation Brain Model for Embodied Intelligence

Yi Zhang, Che Liu, Xiancong Ren, Hanchu Ni, Shuai Zhang, Zeyuan Ding, Jiayu Hu, Hanzhe Shan, Zhenwei Niu, Zhaoyang Liu, Shuang Liu, Yue Zhao, Junbo Qi, Qinfan Zhang, Dengjie Li, Yidong Wang, Jiachen Luo, Yong Dai, Zenglin Xu, Bin Shen, Qifan Wang, Jian Tang, Xiaozhu Ju

机构 * WFM System Group(WFM系统组) Beijing Innovation Center of Humanoid Robotics (X-Humanoid)(北京人形机器人创新中心(X-Humanoid))

专题命中 指令微调 :SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02529 2025-11-17 cs.LG 57%

RetrySQL: text-to-SQL training with retry data for self-correcting query generation

Alicja Rączkowska, Riccardo Belluzzo, Piotr Zieliński, Joanna Baran, Paweł Olszewski

专题命中 指令微调 :language model(abstract);分类 cs.LG

Comments AAAI 2026 Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 2 篇

2511.10656 2025-11-17 cs.CL cs.AI 88%

Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models

Biao Liu, Ning Xu, Junming Yang, Xin Geng

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications(新一代人工智能技术及其交叉应用关键实验室) Ministry of Education(教育部)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16927 2025-11-17 cs.CL cs.AI cs.LG 85%

Latent Principle Discovery for Language Model Self-Improvement

Keshav Ramji, Tahira Naseem, Ramón Fernandez Astudillo

机构 * IBM Research AI(IBM人工智能研究)

专题命中 后训练与偏好优化 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 4 篇

2509.24037 2025-11-17 cs.CR 89%

Automated Vulnerability Validation and Verification: A Large Language Model Approach

Alireza Lotfi, Charalampos Katsis, Elisa Bertino

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10974 2025-11-17 cs.CV 67%

Preserving Cross-Modal Consistency for CLIP-based Class-Incremental Learning

Haoran Chen, Houze Xu, Micah Goldblum, Daoguo Dong, Zuxuan Wu

机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究院) Fudan University(复旦大学) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心) Columbia University(哥伦比亚大学)

专题命中 长上下文与记忆 :language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10753 2025-11-17 cs.DC cs.AR 67%

FengHuang: Next-Generation Memory Orchestration for AI Inferencing

Jiamin Li, Lei Qu, Tao Zhang, Grigory Chirkov, Shuotao Xu, Peng Cheng, Lidong Zhou

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10720 2025-11-17 cs.CR cs.AI cs.CL cs.LG 67%

PISanitizer: Preventing Prompt Injection to Long-Context LLMs via Prompt Sanitization

Runpeng Geng, Yanting Wang, Chenlong Yin, Minhao Cheng, Ying Chen, Jinyuan Jia

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The code is available at https://github.com/sleeepeer/PISanitizer

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 33 篇

2511.10714 2025-11-17 cs.CR cs.AI 90%

BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models

Shuaitong Liu, Renjue Li, Lijia Yu, Lijun Zhang, Zhiming Liu, Gaojie Jin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at AAAI 2026 (Main Track). This arXiv version corresponds to the camera-ready manuscript and includes expanded appendices. Please cite the AAAI 2026 version when available

详情

展开后加载摘要…

URL PDF HTML 收藏