arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11692 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11692 篇

2602.12419 2026-02-16 cs.AI 88%

Intent-Driven Smart Manufacturing Integrating Knowledge Graphs and Large Language Models

意图驱动的智能制造整合知识图谱和大语言模型

Takoua Jradi, John Violos, Dimitrios Spatharakis, Lydia Mavraidi, Ioannis Dimolitsas, Aris Leivadeas, Symeon Papavassiliou

机构 * 1Department of Software IT Engineering, École de technologie supérieure, Montreal, Canada 2School of Electrical \& Computer Engineering, National Technical University of Athens

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出结合大语言模型和知识图谱的意图驱动智能制造框架,通过微调和语义映射提升制造系统的人机交互性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05228 2026-02-12 cs.AI 88%

Surgery: Mitigating Harmful Fine-Tuning for Large Language Models via Attention Sink

手术:通过注意力sink缓解大型语言模型的有害微调

Guozhi Liu, Weiwei Lin, Tiansheng Huang, Ruichao Mo, Qi Mu, Xiumin Wang, Li Shen

机构 * South China University of Technology(南方科技大学) Pengcheng Laboratory(鹏城实验室) Sun Yat-sen University(中山大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 Surgery通过注意力sink机制在微调阶段抑制有害模式学习,提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20906 2026-02-11 cs.LG 88%

TwinWeaver: An LLM-Based Foundation Model Framework for Pan-Cancer Digital Twins

TwinWeaver: 一种基于大语言模型的跨癌症数字双胞胎基础模型框架

Nikita Makarov, Maria Bordukova, Lena Voith von Voithenberg, Estrella Pivel-Villanueva, Sabrina Mielke, Jonathan Wickes, Hanchen Wang, Mingyu Derek Ma, Keunwoo Choi, Kyunghyun Cho, Stephen Ra, Raul Rodriguez-Esteban, Fabian Schmich, Michael Menden

机构 * Computational Sciences Center of Excellence, Roche, Penzberg, Germany(罗氏计算科学卓越中心) Computational Health Center, Helmholtz Munich, Munich, Germany(海德堡慕尼黑计算健康中心) Department of Biology, Ludwig Maximilian University of Munich, Munich, Germany(慕尼黑路易斯·马克西米利安大学生物学系) Early Development Oncology, Roche Innovation Center Zurich, Roche, Schlieren, Switzerland(罗氏苏黎世创新中心早期肿瘤学) Computational Sciences Center of Excellence, Genentech, New York City, USA(基因泰克计算科学卓越中心) Computational Sciences Center of Excellence, Genentech, South San Francisco, USA(基因泰克计算科学卓越中心) Center for Data Science, New York University, New York City, USA(纽约大学数据科学中心) Department of Computer Science, Stanford University, Stanford, CA, USA(斯坦福大学计算机科学系) Computational Sciences Center of Excellence, Roche, Basel, Switzerland(罗氏巴塞尔计算科学卓越中心) Department of Biochemistry(生物化学系) Biotechnology Institute, The University of Melbourne, Melbourne, Australia(墨尔本大学生物技术研究所)

专题命中 指令微调 :LLM(title);foundation model(title);large language model(abstract);language model(abstract)

AI总结 TwinWeaver通过基于大语言模型的框架,构建跨癌症数字双胞胎,提升临床事件预测与风险分层精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05694 2026-02-06 cs.CL 88%

Consensus-Aligned Neuron Efficient Fine-Tuning Large Language Models for Multi-Domain Machine Translation

共识对齐的神经高效细调大型语言模型用于多领域机器翻译

Shuting Jiang, Ran Song, Yuxin Huang, Yan Xiang, Yantuan Xian, Shengxiang Gao, Zhengtao Yu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出一种神经高效微调框架,通过识别和更新共识对齐的神经元,提升大型语言模型在多领域机器翻译中的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13580 2026-02-05 cs.CL 88%

Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models

稀疏子网络增强用于大型语言模型中资源匮乏语言

Daniil Gurgurov, Tanja Baeumel, Josef van Genabith, Simon Ostermann

机构 * Saarland University(萨尔兰大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Centre for European Research in Trusted AI (CERTAIN)(欧洲可信人工智能研究中心)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出通过稀疏子网络增强方法,提升大型语言模型在资源匮乏语言上的性能,同时保持通用能力,并展示了其在多个语言模型上的有效性。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00038 2026-02-03 cs.CY cs.AI 88%

LSSF: Safety Alignment for Large Language Models through Low-Rank Safety Subspace Fusion

LSSF: 通过低秩安全子空间融合实现大语言模型的安全对齐

Guanghao Zhou, Panjia Qiu, Cen Chen, Hongyu Li, Mingyuan Chu, Xin Zhang, Jun Zhou

机构 * East China Normal University(华东师范大学) Ant Group(蚂蚁集团)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 LSSF通过低秩安全子空间融合技术,有效恢复微调大语言模型的安全对齐,同时对性能影响较小。

Comments Accepted in ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06100 2026-01-26 cs.CL 88%

Orthogonal Low-rank Adaptation in Lie Groups for Continual Learning of Large Language Models

在李群中实现正交低秩适应用于大语言模型的持续学习

Kefan Cao, Shuaicheng Wu

机构 * Yingcai Honor College, University of Electronic Science and Technology of China(电子科技大学荣誉学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 OLieRA通过基于李群的乘法更新和任务子空间正交性,有效解决大语言模型在持续学习中的灾难性遗忘问题,实现性能和鲁棒性的提升。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13995 2026-01-21 cs.CL 88%

From Tags to Trees: Structuring Fine-Grained Knowledge for Controllable Data Selection in LLM Instruction Tuning

从标签到树:为LLM指令微调中的可控数据选择构建细粒度知识

Zihan Niu, Wenping Hu, Junmin Chen, Xiyue Wang, Tong Xu, Ruiming Tang

机构 * University of Science and Technology of China(中国科学技术大学) Klear Team, Kuaishou Technology(快手科技Klear团队)

专题命中 指令微调 :LLM(title,abstract);instruction tuning(title,abstract);分类 cs.CL

AI总结 TAGS通过构建细粒度知识树,实现LLM指令微调中可控数据选择的高效采样与知识对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11573 2026-01-21 cs.CL 88%

An Empirical Analysis of Fine-Tuning Large Language Models on Bioinformatics Literature: PRSGPT and BioStarsGPT

对在生物信息学文献上微调大型语言模型的实证分析:PRSGPT和BioStarsGPT

Muhammad Muneeb, David B. Ascher

机构 * School of Chemistry and Molecular Biology(化学与分子生物学学院) The University of Queensland(昆士兰大学) Baker Heart and Diabetes Institute(贝克心脏与糖尿病研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出了一种可重复的管道,用于在生物信息学文献上微调大型语言模型,通过PRSGPT和BioStarsGPT两个用例展示了方法和成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09035 2026-01-15 cs.CR cs.AI 88%

A Decompilation-Driven Framework for Malware Detection with Large Language Models

基于大语言模型的反恶意软件检测解编驱动框架

Aniesh Chawla, Udbhav Prasad

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的反恶意软件检测框架,通过解编和微调提升恶意软件检测效果,但需持续更新以应对新型威胁。

Comments 6 pages, published in 2025 IEMCON

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23881 2026-01-01 cs.SD cs.AI cs.CR 88%

Breaking Audio Large Language Models by Attacking Only the Encoder: A Universal Targeted Latent-Space Audio Attack

通过仅攻击编码器打破音频大语言模型:一种通用的目标潜在空间音频攻击

Roee Ziv, Raz Lapid, Moshe Sipper

机构 * Ben Gurion University of the Negev(贝纳乔大学奈夫分校) Deepkeep

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出了一种针对音频大语言模型编码器的通用潜在空间攻击方法,通过操纵音频潜在表示实现目标输出,展示了编码器层面的安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18878 2025-12-23 cs.CV cs.AI 88%

CrashChat: A Multimodal Large Language Model for Multitask Traffic Crash Video Analysis

CrashChat: 一种多模态大语言模型用于多任务交通事故视频分析

Kaidi Liang, Ke Li, Xianbiao Hu, Ruwen Qin

机构 * Stony Brook University(石溪大学) The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CrashChat是一种多模态大语言模型,用于多任务交通事故视频分析,通过任务解耦和分组策略提升事故识别、定位等任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17344 2025-12-22 cs.CL 88%

Governance-Aware Hybrid Fine-Tuning for Multilingual Large Language Models

面向治理的混合微调方法用于多语言大语言模型

Haomin Qi, Chengbo Huang, Zihan Dai, Yunkai Gao

机构 * University of California San Diego(加州大学圣地亚哥分校) Columbia University(哥伦比亚大学) University of Copenhagen(哥本哈根大学) Duke University(杜克大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出面向治理的混合微调方法,通过结合低秩更新和正交变换提升多语言大模型的适应效率与准确性。

Comments 11 pages, 4 figures, 6 tables. arXiv admin note: substantial text overlap with arXiv:2507.18076

Journal ref 2025 IEEE International Conference on Big Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13714 2025-12-17 cs.AI 88%

AI-Powered Annotation Pipelines for Stabilizing Large Language Models: A Human-AI Synergy Approach

基于AI的标注流程用于稳定大语言模型:一种人机协同方法

Gangesh Pathak, Prasanna Kumar

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);RLHF(abstract)

AI总结 本文提出了一种基于AI的标注流程,通过人机协同方法系统识别并修复大语言模型的不稳定性,提升模型的可靠性和鲁棒性。

Comments 16 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00522 2025-12-16 cs.CL 88%

Efficiently Seeking Flat Minima for Better Generalization in Fine-Tuning Large Language Models and Beyond

高效寻找平坦极小值以提升大型语言模型及其他模型的泛化能力

Jiaxin Deng, Qingcheng Zhu, Junbiao Pang, Linlin Yang, Zhongqian Fu, Baochang Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出EFMLoRA,通过寻找LoRA的平坦极小值提升模型泛化能力,实验表明其在效率和性能上均优于传统LoRA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07175 2025-12-09 cs.LG 88%

SPACE: Noise Contrastive Estimation Stabilizes Self-Play Fine-Tuning for Large Language Models

SPACE:噪声对比估计稳定了大语言模型的自我对战微调

Yibo Wang, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Lijun Zhang

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Alibaba International Digital Commerce(阿里巴巴国际数字商业) Pazhou Laboratory (Huangpu)(琶洲实验室(黄埔))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 SPACE通过噪声对比估计稳定大语言模型的自我对战微调,提升下游任务性能

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14997 2025-12-09 cs.CV cs.LG 88%

Language Integration in Fine-Tuning Multimodal Large Language Models for Image-Based Regression

基于图像回归的多模态大语言模型微调中的语言整合

Roy H. Jennings, Genady Paikin, Roy Shaul, Evgeny Soloveichik

机构 * Samsung Israel R&D Center(三星以色列研发中心)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出RvTC方法,通过灵活的区间法替代传统词汇受限分类,提升多模态大语言模型在图像回归任务中的性能。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06787 2025-12-09 cs.CL 88%

LLM4SFC: Sequential Function Chart Generation via Large Language Models

LLM4SFC: 通过大语言模型生成顺序功能图

Ofek Glick, Vladimir Tchuiev, Marah Ghoummaid, Michal Moshkovitz, Dotan Di-Castro

机构 * Bosch Research(博世研究)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 LLM4SFC通过大语言模型生成可执行的顺序功能图,实现图形与文本PLC语言的高效转换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16159 2025-12-09 cs.CL cs.CE 88%

ZiGong 1.0: A Large Language Model for Financial Credit

ZiGong 1.0:一种用于金融信用的大型语言模型

Yu Lei, Zixuan Wang, Chu Liu, Tongyao Wang

机构 * Didi International Business(滴滴国际业务)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 ZiGong 1.0通过多任务监督微调和数据修剪方法,提升大型语言模型在金融信用评估中的性能和鲁棒性。

Journal ref 2025 IEEE 41st International Conference on Data Engineering Workshops (ICDEW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21393 2025-12-03 cs.CR cs.AI 88%

VeriLoRA: Fine-Tuning Large Language Models with Verifiable Security via Zero-Knowledge Proofs

VeriLoRA: 通过零知识证明实现通过验证的安全大语言模型微调

Guofu Liao, Taotao Wang, Shengli Zhang, Jiqun Zhang, Shi Long, Dacheng Tao

机构 * Shenzhen University(深圳大学) Nanjing University of Science(南京理工大学) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 VeriLoRA通过整合零知识证明与LoRA微调,实现了大语言模型在敏感环境中的安全可信部署。

Comments This paper has been accepted for publication at the Network and Distributed System Security Symposium (NDSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21930 2025-12-01 cs.CL 88%

A Comparative Study of LLM Prompting and Fine-Tuning for Cross-genre Authorship Attribution on Chinese Lyrics

跨流派中文歌词作者归属的LLM提示与微调比较研究

Yuxin Li, Lorraine Xu, Meng Fan Wang

机构 * Columbia University(哥伦比亚大学)

专题命中 指令微调 :LLM(title,abstract);prompting(title);pretraining(abstract);分类 cs.CL

AI总结 本文通过对比LLM提示与微调方法,研究中文歌词跨流派作者归属问题,提出新的数据集和领域模型,并探讨流派对性能的影响。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20072 2025-11-27 cs.CL 88%

MTA: A Merge-then-Adapt Framework for Personalized Large Language Model

MTA: 一种用于个性化大语言模型的融合后再适应框架

Xiaopeng Li, Yuanjin Zheng, Wanyu Wang, wenlin zhang, Pengyue Jia, Yiqi Wang, Maolin Wang, Xuetao Wei, Xiangyu Zhao

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 MTA通过融合后再适应框架,解决个性化大语言模型在存储成本和数据稀疏性方面的挑战,实现高效动态个性化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20192 2025-11-26 cs.LG cs.IR 88%

FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement

FunReason: 通过自精炼多尺度损失和自动化数据精炼增强大语言模型的功能调用

Bingguang Hao, ZengZhuang Xu, Maolin Wang, Yuntao Wen, Yicheng Chen, Cunyin Peng, Long Chen, Dong Wang, Xiangyu Zhao, Jinjie Gu, Chenyi Zhuang, Ji Zhang

机构 * AWorld Team, Inclusion AI(AWorld Team,Inclusion AI) City University of Hong Kong(香港城市大学) Southwest Jiaotong University(西南交通大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 FunReason通过自精炼多尺度损失和自动化数据精炼方法,提升大语言模型的功能调用能力,实现性能接近GPT-4o并缓解微调中的灾难性遗忘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14423 2025-11-19 cs.CL 88%

Unified Defense for Large Language Models against Jailbreak and Fine-Tuning Attacks in Education

Xin Yi, Yue Li, Dongsheng Shi, Linlin Wang, Xiaoling Wang, Liang He

机构 * Shanghai Institute of Artificial Intelligence for Education, East China Normal University, Shanghai 200062, China(教育人工智能研究所,华东师范大学,上海200062,中国) School of Computer Science and Technology, East China Normal University, Shanghai 200062, China(计算机科学与技术学院,华东师范大学,上海200062,中国) School of Computer Science(计算机科学学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11677 2025-11-18 cs.LG q-fin.GN 88%

Instruction Tuning Chronologically Consistent Language Models

Songrun He, Linying Lv, Asaf Manela, Jimmy Wu

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 指令微调 :language model(title,abstract);instruction tuning(title);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12414 2025-11-18 cs.LG cs.CR 88%

The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models

Yuting Tan, Yi Huang, Zhuo Li

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02360 2025-11-18 cs.CL 88%

Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models

Jiayi Zhang, Shu Yang, Junchao Wu, Derek F. Wong, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能和数据分析实验室) King Abdullah University of Science and Technology (KAUST)(卡布斯科学技术大学) University of Copenhagen(哥本哈根大学) University of Macau(澳门大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23015 2025-11-13 cs.CL 88%

Detecting Stealthy Backdoor Samples based on Intra-class Distance for Large Language Models

Jinwen Chen, Hainan Zhang, Fei Sun, Qinnan Zhang, Sijia Wen, Ziwei Wang, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(未来区块链与隐私计算先进创新中心) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP2025Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07481 2025-11-12 cs.LG 88%

Comparing Reconstruction Attacks on Pretrained Versus Full Fine-tuned Large Language Model Embeddings on Homo Sapiens Splice Sites Genomic Data

Reem Al-Saidi, Erman Ayday, Ziad Kobti

机构 * School of Computer Science University of Windsor(计算机科学学院 温莎大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05286 2025-11-10 cs.CL 88%

Reflective Personalization Optimization: A Post-hoc Rewriting Framework for Black-Box Large Language Models

Teqi Hao, Xioayu Tan, Shaojie Shi, Yinghui Xu, Xihe Qiu

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(上海工程技术大学电子与电气工程学院) Tencent Youtu Lab(腾讯优图实验室) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏