arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2606.08908 2026-06-09 cs.CV cs.AI 新提交 74%

Failure-Aware Refinement of Vision-Language Model for Lithography Defect Detection

面向光刻缺陷检测的视觉-语言模型失败感知精炼

Pangyun Jeong, Jiyeong Kong, Yuehua Hu, Dohee Jeong, Kyung-Tae Kang

机构 * Hanyang University(汉阳大学) Korea University(高丽大学) Korea Institute of Industrial Technology(韩国生产技术研究院)

专题命中 指令微调 :language model(title);分类 cs.AI

AI总结 提出两阶段视觉-语言框架,先微调Qwen3-VL检测缺陷,再通过训练精炼模块修正第一阶段错误,提升检测可靠性。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01695 2026-06-02 cs.LG 74%

CANARY: Zero-Label Detection of Fine-Tuning Contamination in Language Models

CANARY: 语言模型中微调污染的无标签检测

Swapnil Parekh

机构 * Switzerland(瑞士)

专题命中 指令微调 :language model(title);分类 cs.LG

AI总结 提出CANARY方法,通过稀疏自编码器分析隐藏状态差异,在无标签情况下检测微调数据污染,实现1%污染率下AUROC=1.000,并支持检测、验证、优先排序和修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02578 2026-06-01 q-bio.BM cs.LG 74%

FLOWR.root: A flow matching based foundation model for joint multi-purpose structure-aware 3D ligand generation and affinity prediction

FLOWR.root:基于流匹配的基础模型,用于联合多用途结构感知3D配体生成和亲和力预测

Julian Cremer, Tuan Le, Mohammad M. Ghahremanpour, Emilia Sługocka, Filipe Menezes, Djork-Arné Clevert

机构 * Machine Learning & Computational Sciences, Pfizer Worldwide R&D(辉瑞全球研发 机器学习与计算科学部) Computational Chemistry, Medicine Design, Pfizer Worldwide R&D(辉瑞全球研发 计算化学与医学设计部) Doctoral School of Medical and Health Sciences, Jagiellonian University Medical College(杰拉西利昂大学医学院医学与健康科学博士学院) Department of Physicochemical Drug Analysis, Faculty of Pharmacy, Jagiellonian University Medical College(杰拉西利昂大学医学院药物物理化学分析系) Institute of Structural Biology, Molecular Targets and Therapeutics Center, Helmholtz Munich(海德堡-慕尼黑分子靶点与治疗中心 结构生物学研究所) TUM School of Natural Sciences, Department of Bioscience, Bayerisches NMR Zentrum, Technical University of Munich(慕尼黑技术大学自然科学学院 生物科学系,拜耳核磁共振中心)

专题命中 指令微调 :foundation model(title);分类 cs.LG

AI总结 提出SE(3)-等变流匹配模型FLOWR.root,实现口袋感知的3D配体生成、效力与结合亲和力预测及置信度估计,支持从头生成、条件采样、片段优化替换及多终点亲和力预测,在无条件分子生成和口袋条件配体生成上达到最优性能,并通过参数高效微调在亲和力预测上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17261 2026-05-25 cs.LG 74%

AGZO: Activation-Guided Zeroth-Order Optimization for LLM Fine-Tuning

AGZO:用于大语言模型微调的激活引导零阶优化

Wei Lin, Yining Jiang, Qingyu Song, Qiao Xiang, Hong Xu

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学计算机科学与工程系) Xiamen University, China(厦门大学)

专题命中 指令微调 :LLM(title);分类 cs.LG

AI总结 提出激活引导零阶优化方法AGZO,利用前向传播中的激活结构限制扰动到低秩子空间,在保持低内存的同时提升更新方向与真实梯度的余弦相似度,缩小与一阶微调的性能差距。

Comments 21 pages in total, including 9 pages of main text, with 4 figures and 3 tables Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19799 2026-05-20 cs.CV cs.AI 74%

Synergistic Foundation Models for Semi-Supervised Fetal Cardiac Ultrasound Analysis: SAM-Med2D Boundary Refinement and DINOv3 Semantic Enhancement

协同基础模型用于半监督胎儿心脏超声分析:SAM-Med2D边界细化与DINOv3语义增强

Tonghao Zhuang, Shanglong Hu, Yongsheng Luo, Zhiqi Zhang, Yu Li

机构 * Zhuhai College of Science and Technology(珠海科技学院)

专题命中 指令微调 :foundation model(title);分类 cs.AI

AI总结 本文提出了一种半监督框架,用于胎儿心脏超声图像的联合分割和分类,结合SAM-Med2D进行边界细化和DINOv3进行语义增强,有效提升了胎儿先天性心脏病筛查的性能。

Comments Accepted to the ISBI 2026 Fetal HearT UltraSound Segmentation and Diagnosis (FETUS) Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03396 2026-04-23 cs.CL 74%

Breaking the Assistant Mold: Modeling Behavioral Variation in LLM Based Procedural Character Generation

打破助手模式:在基于大语言模型的程序化角色生成中建模行为变异

Maan Qraitem, Kate Saenko, Bryan A. Plummer

机构 * Boston University(波士顿大学)

专题命中 指令微调 :LLM(title);分类 cs.CL

AI总结 本文提出PersonaWeaver框架,通过解耦世界观构建与行为构建,生成更具多样性和戏剧张力的角色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10341 2026-04-14 cs.AI 74%

VeriTrans: Fine-Tuned LLM-Assisted NL-to-PL Translation via a Deterministic Neuro-Symbolic Pipeline

VeriTrans:通过确定性神经符号流水线进行细调的LLM辅助自然语言到形式语言翻译

Xuan Liu, Dheeraj Kodakandla, Kushagra Srivastva, Mahfuza Farooque

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 指令微调 :LLM(title);分类 cs.AI

AI总结 VeriTrans通过确定性神经符号流水线,利用细调的LLM辅助自然语言到形式语言翻译,提升翻译准确性和可靠性,同时通过高精度回环验证和日志记录支持审计和调试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13855 2026-04-03 cs.CV cs.AI 74%

Improvise, Adapt, Overcome -- Telescopic Adapters for Efficient Fine-tuning of Vision Language Models in Medical Imaging

即兴、适应、克服——用于医疗影像中视觉语言模型高效微调的望远镜适配器

Ujjwal Mishra, Vinita Shukla, Praful Hambarde, Amit Shukla

机构 * Centre for Artificial Intelligence and Robotics, Indian Institute of Technology Mandi(印度理工学院曼迪分校人工智能与机器人中心)

专题命中 指令微调 :language model(title);分类 cs.AI

AI总结 本文提出望远镜适配器,通过深度感知缩放提升视觉语言分割模型在医疗影像中的微调效率,仅用613k参数在五个数据集上取得优异性能。

Comments Accepted at the IEEE/CVF winter conference on applications of computer vision (WACV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20089 2026-03-03 cs.CV cs.AI 74%

StructXLIP: Enhancing Vision-language Models with Multimodal Structural Cues

StructXLIP: 通过多模态结构线索增强视觉-语言模型

Zanxi Ruan, Songqun Gao, Qiuyu Kong, Yiming Wang, Marco Cristani

专题命中 指令微调 :language model(title);分类 cs.AI

AI总结 StructXLIP通过引入多模态结构线索提升视觉-语言模型的跨模态检索性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21294 2026-02-27 cs.CL 74%

UPDESH: Synthesizing Grounded Instruction Tuning Data for 13 Indic Languages

UPDESH: 为13种印地语系语言合成基于现实的指令微调数据

Pranjal A. Chitale, Varun Gumma, Sanchit Ahuja, Prashant Kodali, Manan Uppadhyay, Deepthi Sudharsan, Sunayana Sitaram

机构 * Microsoft Corporation(微软公司) Nanyang Technological University(南洋理工大学) Northeastern University(东北大学) Independent Researcher(独立研究者)

专题命中 指令微调 :instruction tuning(title);分类 cs.CL

AI总结 UPDESH通过基于维基百科内容的自下而上方法,生成高质量的多语言指令数据,提升多语言AI系统的文化适应性与性能。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13384 2026-01-21 cs.SE cs.CL 74%

From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning

从补全到编辑:通过搜索和替换指令微调解锁上下文感知的代码填充

Jiajun Zhang, Zeyu Cui, Jiaxi Yang, Lei Zhang, Yuheng Jing, Zeyao Ma, Tianyi Bai, Zilei Wang, Qiang Liu, Liang Wang, Binyuan Hui, Junyang Lin

机构 * USTC(University of Science and Technology of China) Alibaba Group(阿里巴巴集团) CASIA(Chinese Academy of Sciences Institute of Automation) SIAT(Institute of Automation, Chinese Academy of Sciences)

专题命中 指令微调 :instruction tuning(title);分类 cs.CL

AI总结 通过搜索和替换指令微调,SRI框架实现了上下文感知的代码填充,提升了补全性能并保持低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08189 2026-01-21 cs.CR cs.AI 74%

ForgetMark: Stealthy Fingerprint Embedding via Targeted Unlearning in Language Models

ForgetMark: 通过针对性遗忘实现语言模型的隐秘指纹嵌入

Zhenhua Xu, Haobo Zhang, Zhebo Wang, Qichen Liu, Haitao Xu, Wenpeng Xing, Meng Han

机构 * Zhejiang University(浙江大学) Zhejiang University of Technology(浙江工业大学)

专题命中 指令微调 :language model(title);分类 cs.AI

AI总结 ForgetMark通过针对性遗忘技术,在语言模型中实现隐秘指纹嵌入,提升隐蔽性和鲁棒性,同时保持模型性能。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12533 2025-12-16 cs.CL 74%

Relation Extraction or Pattern Matching? Unravelling the Generalisation Limits of Language Models for Biographical RE

关系抽取还是模式匹配?揭示语言模型在生物信息关系抽取中的泛化极限

Varvara Arzt, Allan Hanbury, Michael Wiegand, Gábor Recski, Terra Blevins

机构 * Faculty of Informatics, TU Wien(信息学院,维也纳技术大学) D!ARC, University of Klagenfurt(D!ARC,克雷格福特大学) Digital Philology, University of Vienna(数字人文,维也纳大学) Khoury College of Computer Sciences, Northeastern University(科赫计算机科学学院,东北大学)

专题命中 指令微调 :language model(title);分类 cs.CL

AI总结 本研究揭示了语言模型在生物信息关系抽取任务中的泛化极限,指出数据质量和适应策略选择对迁移能力的影响,并指出现有基准的结构性问题限制了模型性能。

Comments Accepted as a main conference paper at IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10694 2025-11-20 cs.CL 74%

Where does an LLM begin computing an instruction?

Aditya Pola, Vineeth N. Balasubramanian

机构 * Indian Institute of Technology, Hyderabad(印度海得拉巴印度理工学院)

专题命中 指令微调 :LLM(title);分类 cs.CL

Comments Extended Abstract accepted at UniReps '25 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00829 2025-11-18 cs.CL 74%

Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine Translation

Yanming Sun, Runzhe Zhan, Chi Seng Cheang, Han Wu, Xuebo Liu, Yuyao Niu, Fengying Ye, Kaixin Lan, Lidia S. Chao, Derek F. Wong

专题命中 指令微调 :LLM(title);分类 cs.CL

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08806 2025-11-13 cs.CL 74%

Toward Automated Cognitive Assessment in Parkinson's Disease Using Pretrained Language Models

Varada Khanna, Nilay Bhatt, Ikgyu Shin, Sule Tinaz, Yang Ren, Hua Xu, Vipina K. Keloth

专题命中 指令微调 :language model(title);分类 cs.CL

Comments 15 pages, 4 figures, 1 table. Varada Khanna and Nilay Bhatt are co-first authors. Sule Tinaz and Hua Xu are co-senior authors. Corresponding author: Vipina K. Keloth (vipina.kuttichikeloth@yale.edu)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04863 2025-10-21 cs.LG q-bio.BM 74%

OneProt: Towards Multi-Modal Protein Foundation Models

Klemens Flöge, Srisruthi Udayakumar, Johanna Sommer, Marie Piraud, Stefan Kesselheim, Vincent Fortuin, Stephan Günneman, Karel J van der Weg, Holger Gohlke, Erinc Merdivan, Alina Bazarova

专题命中 指令微调 :foundation model(title);分类 cs.LG

Comments 34 pages, 7 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25193 2025-10-01 cs.SE cs.AI 74%

Devstral: Fine-tuning Language Models for Coding Agent Applications

Abhinav Rastogi, Adam Yang, Albert Q. Jiang, Alexander H. Liu, Alexandre Sablayrolles, Amélie Héliou, Amélie Martin, Anmol Agarwal, Andy Ehrenberg, Andy Lo, Antoine Roux, Arthur Darcet, Arthur Mensch, Baptiste Bout, Baptiste Rozière, Baudouin De Monicault, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clémence Lanfranchi, Clément Denoix, Corentin Barreau, Darius Dabert Devon Mizelle, Diego de las Casas, Elliot Chane-Sane, Emilien Fugier, Emma Bou Hanna, Gabrielle Berrada, Gauthier Delerce, Gauthier Guinet, Georgii Novikov, Graham Neubig, Guillaume Lample, Guillaume Martin, Himanshu Jaju, Jan Ludziejewski, Jason Rute, Jean-Malo Delignon, JeanHadrien Chabran, Joachim Studnia, Joep Barmentlo, Jonas Amar, Josselin Somerville Roberts, Julien Denize, Karan Saxena, Karmesh Yadav, Kartik Khandelwal, Khyathi Raghavi Chandu, Kush Jain, Lélio Renard Lavaud, Léonard Blier, Lingxiao Zhao, Louis Martin, Lucile Saulnier, Luyu Gao, Marie Pellat, Mathilde Guillaumin, Mathis Felardos, Matthieu Dinot, Maxime Darrin, Maximilian Augustin, Mickaël Seznec, Neha Gupta, Nikhil Raghuraman, Olivier Duchenne, Patricia Wang, Patrick von Platen, Patryk Saffer, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Philomène Chagniot, Pierre Stock, Pravesh Agrawal, Rémi Delacourt, Roman Soletskyi, Romain Sauvestre, Sagar Vaze, Sanchit Gandhi, Sandeep Subramanian, Shashwat Dalal, Siddharth Gandhi, Soham Ghosh, Srijan Mishra, Sumukh Aithal, Szymon Antoniak, Teven Le Scao, Thibaut Lavril, Thibault Schueller, Thomas Foubert, Thomas Robert, Thomas Wang, Timothée Lacroix, Tom Bewley, Valeriia Nemychnikova, Victor Paltz, Virgile Richard, Wen-Ding Li, William Marshall, Xingyao Wang, Xuanyu Zhang, Yihan Wan, Yunhao Tang

机构 * Mistral AI

专题命中 指令微调 :language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00419 2025-09-15 physics.geo-ph cs.AI 74%

Geological Everything Model 3D: A Promptable Foundation Model for Unified and Zero-Shot Subsurface Understanding

Yimin Dou, Xinming Wu, Nathan L Bangs, Harpreet Singh Sethi, Jintao Li, Hang Gao, Zhixiang Guo

机构 * University of Science and Technology of China, School of Earth and Space Sciences(中国科学技术大学地球和空间科学学院) University of Texas at Austin, UT Institute for Geophysics(德克萨斯大学奥斯汀分校UT地球物理研究所) NVIDIA(NVIDIA公司)

专题命中 指令微调 :foundation model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01225 2025-08-25 cs.CV cs.AI 74%

Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models

Xinyu Chen, Haotian Zhai, Can Zhang, Xiupeng Shi, Ruirui Li

机构 * Shanghai University(上海大学) Beijing University of Chemical Technology(北京化工大学) University of Minnesota(明尼苏达大学)

专题命中 指令微调 :language model(title);分类 cs.AI

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14718 2025-08-21 cs.CL 74%

The Digital Sous Chef -- A Comparative Study on Fine-Tuning Language Models for Recipe Generation

Shubham Pundhir, Ganesh Bagler

机构 * Indraprastha Institute of Information Technology(印度理工学院信息技术研究所)

专题命中 指令微调 :language model(title);分类 cs.CL

Comments 8 pages, 4 figures. Code is available at: https://github.com/shubh-iiit/RecipeGPT2-Your-Own-AI-Chef

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07577 2025-08-12 cs.CV cs.LG 74%

Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification

Zhaorui Tan, Tan Pan, Kaizhu Huang, Weimiao Yu, Kai Yao, Chen Jiang, Qiufeng Wang, Anh Nguyen, Xin Guo, Yuan Cheng, Xi Yang

机构 * Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Liverpool(利物浦大学) AI 3 Fudan University(复旦大学) Duke Kunshan University(杜克-昆山大学) BII, A ∗ STAR Zhejiang University(浙江大学)

专题命中 指令微调 :foundation model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05895 2025-08-06 cs.CV cs.AI 74%

Leveraging Vision-Language Models for Visual Grounding and Analysis of Automotive UI

Benjamin Raphael Ernhofer, Daniil Prokhorov, Jannica Langner, Dominik Bollmann

机构 * SPARKS Solutions GmbH(SPARKS解决方案有限公司)

专题命中 指令微调 :language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16847 2025-07-24 cs.SI cs.IR cs.LG 74%

EVOLVE-X: Embedding Fusion and Language Prompting for User Evolution Forecasting on Social Media

Ismail Hossain, Sai Puppala, Md Jahangir Alam, Sajedul Talukder

机构 * Computer Science University of Texas at El Paso(计算机科学德克萨斯大学埃尔帕索分校) School of Computing Southern Illinois University(计算学院南方伊利诺伊大学)

专题命中 指令微调 :prompting(title);分类 cs.LG

Comments We are submitting this paper to ICWSM 2026 conference on September 15th, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07247 2025-06-10 cs.LG 74%

Promoting Ensemble Diversity with Interactive Bayesian Distributional Robustness for Fine-tuning Foundation Models

Ngoc-Quan Pham, Tuan Truong, Quyen Tran, Tan Nguyen, Dinh Phung, Trung Le

机构 * Qualcomm AI Research, Qualcomm Vietnam Company Limited(高通人工智能研究, 高通越南公司) National University of Singapore, Singapore(新加坡国立大学) Monash University, Australia(墨尔本大学)

专题命中 指令微调 :foundation model(title);分类 cs.LG

Comments ICML 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20356 2025-04-30 cs.CL 74%

What Causes Knowledge Loss in Multilingual Language Models?

Maria Khelli, Samuel Cahyawijaya, Ayu Purwarianti, Genta Indra Winata

机构 * Institut Teknologi Bandung(技术科技大学) Cohere Capital One

专题命中 指令微调 :language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11268 2025-04-16 cs.CV cs.AI 74%

Single-Input Multi-Output Model Merging: Leveraging Foundation Models for Dense Multi-Task Learning

Juan Garcia Giraldo, Nikolaos Dimitriadis, Ke Wang, Pascal Frossard

机构 * EPFL(洛桑联邦理工学院)

专题命中 指令微调 :foundation model(title);分类 cs.AI

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01218 2025-04-03 cs.LG cs.CV 74%

Prompting Forgetting: Unlearning in GANs via Textual Guidance

Piyush Nagasubramaniam, Neeraj Karamchandani, Chen Wu, Sencun Zhu

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Meta

专题命中 指令微调 :prompting(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08591 2025-03-20 cs.CV cs.AI cs.RO 74%

RoomTour3D: Geometry-Aware Video-Instruction Tuning for Embodied Navigation

Mingfei Han, Liang Ma, Kamila Zhumakhanova, Ekaterina Radionova, Jingyi Zhang, Xiaojun Chang, Xiaodan Liang, Ivan Laptev

机构 * MBZUAI(默罕默德·本·扎耶德人工智能大学) Shenzhen Campus of Sun Yat-Sen University(中山大学深圳校区) AAII, UTS(悉尼科技大学人工智能与创新研究所) University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :instruction tuning(title);分类 cs.AI

Comments CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13269 2024-11-21 cs.SE cs.AI 74%

Towards Specification-Driven LLM-Based Generation of Embedded Automotive Software

Minal Suresh Patil, Gustav Ung, Mattias Nyberg

专题命中 指令微调 :LLM(title);分类 cs.AI

Comments 21 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏