arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11692 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11692 篇

2512.19115 2026-05-12 cs.CV 88%

Generative Giants, Retrieval Weaklings: Why do Multimodal Large Language Models Fail at Multimodal Retrieval?

生成巨人,检索弱者:为何多模态大语言模型在多模态检索中表现不佳?

Hengyi Feng, Zeang Sheng, Meiyi Qiang, Yang Li, Wentao Zhang

机构 * University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) Tencent Inc(腾讯公司) Zhongguancun Academy(中关村学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 研究揭示多模态大语言模型在多模态检索中表现不佳的原因,通过稀疏自编码器分析发现其表示空间主要由文本语义构成,视觉语义不足,导致检索性能下降,提出ReAlign方法提升检索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07764 2026-05-11 cs.RO 88%

CommandSwarm: Safety-Aware Natural Language-to-Behavior-Tree Generation for Robotic Swarms

CommandSwarm: 为机器人群体提供安全意识的自然语言到行为树生成

Mohammed Majid, Amjad Yousef Majid

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出CommandSwarm系统,通过多语言翻译、安全过滤和约束提示生成XML行为树,验证了紧凑量化领域适应的LLM在机器人群体控制中的有效性,强调了解析器接受和安全过滤的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07201 2026-05-11 cs.CL cs.AI cs.LG 88%

PSK@EEUCA 2026: Fine-Tuning Large Language Models with Synthetic Data Augmentation for Multi-Class Toxicity Detection in Gaming Chat

PSK@EEUCA 2026: 通过合成数据增强微调大语言模型用于游戏聊天中的多类毒性检测

Srikar Kashyap Pulipaka

机构 * Independent Researcher(独立研究员)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过合成数据增强微调大语言模型,用于游戏聊天中的多类毒性检测,实验结果显示在测试集上达到0.6234的F1-macro分数,发现验证性能高反而导致测试转移差的'验证陷阱'现象。

Comments Accepted to the EEUCA workshop at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02921 2026-05-05 q-fin.GN q-fin.TR 88%

Debiasing LLMs by Fine-tuning

通过微调去偏大语言模型

Zhenyu Gao, Wenxi Jiang, Yutong Yan

专题命中 指令微调 :LLM(summary_cn,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于监督微调的方法,利用LoRA技术训练指令数据集以减少LLM的预测偏差,通过参数层面干预改善模型的预测能力,实验验证了该方法在控制预测和股票收益预测中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10554 2026-05-05 cs.CV 88%

Grounding Everything in Tokens for Multimodal Large Language Models

基于令牌的多模态大语言模型的 grounding

Xiangxuan Ren, Zhongdao Wang, Liping Hou, Pin Tang, Guoqing Wang, Chao Ma

机构 * MoE Key Lab of Artificial Intelligence(人工智能混合专家模型关键实验室) AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院) Central Research Institute, Huawei(华为中央研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出GETok方法,通过整合可学习的令牌词汇提升多模态大语言模型在2D空间中的物体定位能力,实验显示其在多种指引用例任务中表现更优。

Comments 19 pages, 16 figures, 12 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07050 2026-04-23 cs.IR cs.AI cs.CL cs.LG 88%

ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability

ReasonRank: 通过强推理能力增强文档排序

Wenhan Liu, Xinyu Ma, Weiwei Sun, Yutao Zhu, Yuchen Li, Dawei Yin, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 分校) Baidu Inc., Beijing, China(百度公司,北京,中国) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出ReasonRank,通过自动化生成推理密集型训练数据和两阶段训练方法,提升文档排序性能,实验表明其优于现有基线并具有更低延迟。

Comments 25 pages, accepted by ACL2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10997 2026-03-31 cond-mat.mtrl-sci 88%

Data-driven Prediction of Ionic Conductivity in Solid-State Electrolytes with Machine Learning and Large Language Models

基于机器学习和大语言模型的固态电解质离子导电性数据驱动预测

Haewon Kim, Taekgi Lee, Seongeun Hong, Kyeong-Ho Kim, Yongchul G. Chung

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出利用机器学习和大语言模型预测固态电解质离子导电性,通过结合几何描述符和结构标签数据,提升预测精度并实现可解释的结构-性质分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21077 2026-03-30 cs.CV 88%

CoVFT: Context-aware Visual Fine-tuning for Multimodal Large Language Models

CoVFT:面向多模态大语言模型的上下文感知视觉微调

Nan Zhou, Huiqun Wang, Yaoyan Zheng, Di Huang

机构 * State Key Laboratory of Complex and Critical Software Environment, Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出CoVFT框架,通过整合上下文向量提取和上下文混合专家模块,解决多模态任务中视觉微调的不稳定性问题,实现更稳定的视觉更新。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02465 2026-03-27 eess.SP 88%

Large Language Models Can Achieve Explainable and Training-Free One-shot HRRP ATR

大语言模型可实现可解释且无需训练的一次性高分辨率距离谱自动目标识别

Lingfeng Chen, Panhe Hu, Zhiliang Pan, Qi Liu, Zhen Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出一种无需训练且可解释的框架,利用大语言模型将一维HRRP信号转换为文本散射中心表示,通过少样本上下文学习对齐语义空间,实现无需参数更新的ATR。

Comments Submitted to IEEE SPL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14858 2026-03-06 astro-ph.HE astro-ph.IM 88%

Large Language Model-driven Analysis of General Coordinates Network (GCN) Circulars

基于大语言模型的通用坐标网络(GCN)圆周分析

Vidushi Sharma, Ronit Agarwala, Judith L. Racusin, Leo P. Singer, Tyler Barna, Eric Burns, Michael W. Coughlin, Dakota Dutko, Courey Elliott, Rahul Gupta, Ashish Mahabal, Nikhil Mukund

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文利用大语言模型自动解析GCN圆周,实现暂现体观测信息的高效提取与分类,准确率达97.2%。

Comments 21 pages, 11 figures, 7 tables. Published in ApJS

Journal ref The Astrophysical Journal Supplement Series, 2026, Volume 283, Number 1, Pages 30

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01235 2026-03-04 cs.CR 88%

A Fingerprint for Large Language Models

大型语言模型的指纹

Zhiguang Yang, Hanzhou Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出了一种新型黑盒指纹技术,用于检测大型语言模型的侵权行为,通过分析模型输出的向量空间相似性,实现高效且鲁棒的指纹验证。

Comments Updated by Hanzhou Wu, 8 pages

Journal ref IS&T Electronic Imaging, Media Watermarking, Security, and Forensics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05132 2026-03-03 cs.CL cs.AI cs.LG 88%

Training Large Language Models To Reason In Parallel With Global Forking Tokens

训练大型语言模型以并行推理与全局分叉标记

Sheng Jia, Xiao Wang, Shiva Prasad Kasiviswanathan

机构 * University of Toronto(多伦多大学) Amazon(亚马逊) Vector Institute(向量研究所)

专题命中 指令微调 :large language model(title);language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SSFT和GFPO方法,通过集合基于的损失和双射匹配,提升大型语言模型在并行推理中的多样性和准确性,从而在数学推理和代码生成任务中取得优于传统SFT的性能。

Comments Accepted at ICLR 2026

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026), https://openreview.net/forum?id=xBQvvkg4Wc

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19505 2026-02-24 cs.CV 88%

Test-Time Computing for Referring Multimodal Large Language Models

测试时计算用于指代多模态大语言模型

Mingrui Wu, Hao Chen, Jiayi Ji, Xiaoshuai Sun, Zhiyuan Liu, Liujuan Cao, Ming-Ming Cheng, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,中国教育部,厦门大学) VCIP, CS, Nankai University(VCIP,计算机科学,南开大学) Tsinghua University(清华大学) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 ControlMLLM++通过注入可学习的视觉提示实现多模态大语言模型的测试时适应,提升细粒度视觉推理能力。

Comments arXiv admin note: substantial text overlap with arXiv:2407.21534

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16981 2026-02-16 cs.CR 88%

SmartGuard: Leveraging Large Language Models for Network Attack Detection through Audit Log Analysis and Summarization

SmartGuard: 借助大语言模型通过审计日志分析与总结进行网络攻击检测

Hao Zhang, Shuo Shao, Song Li, Zhenyu Zhong, Yan Liu, Zhan Qin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 SmartGuard通过结合抽象行为与大语言模型,实现基于审计日志的网络攻击检测,具有高准确率和良好的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05485 2026-02-06 cs.CY 88%

Fine-Tuning Large Language Models for Automatic Detection of Sexually Explicit Content in Spanish-Language Song Lyrics

对西班牙语歌曲歌词中色情内容进行自动检测的大型语言模型微调

Dolores Zamacola Sánchez de Lamadrid, Eduardo C. Garrido-Merchán

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文通过微调GPT模型,实现了对西班牙语歌曲歌词中色情内容的自动检测,并提出音乐内容评级的政策建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00777 2026-01-05 cs.SD cs.CV 88%

Investigating the Viability of Employing Multi-modal Large Language Models in the Context of Audio Deepfake Detection

探讨在音频深度伪造检测中使用多模态大语言模型的可行性

Akanksha Chuchra, Shukesh Reddy, Sudeepta Mishra, Abhijit Das, Abhinav Dhall

机构 * Indian Institute of Technology, Ropar, India(印度理工学院罗帕尔分校) Machine Intelligence Group, Birla Institute of Technology and Science, Pilani, Hyderabad Campus, India(比拉理工科学院帕利尼 Hyderabad 分校机器智能小组) Monash University, Melbourne, Australia(墨尔本大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文探讨了多模态大语言模型在音频深度伪造检测中的可行性,通过结合音频输入与多提示方法,展示了模型在域内数据上的良好表现及潜在应用价值。

Comments Accepted at IJCB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09121 2025-12-19 cs.CV 88%

MMRel: Benchmarking Relation Understanding in Multi-Modal Large Language Models

MMRel:多模态大语言模型中关系理解的基准测试

Jiahao Nie, Gongjie Zhang, Wenbin An, Yun Xing, Yap-Peng Tan, Alex C. Kot, Shijian Lu

机构 * Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(南洋理工大学跨学科研究生项目) Alibaba DAMO Academy, Singapore(阿里巴巴达摩院) Xi’an Jiaotong University, China(西安交通大学) Nanyang Technological University, Singapore(南洋理工大学) VinUniversity, Vietnam(文莱大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 MMRel是一个用于评估和提升多模态大语言模型关系理解能力的基准测试,包含大规模高质量的关系数据和对抗性案例,通过实验验证其在提升模型关系理解方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12385 2025-11-18 cs.CR cs.SE 88%

GenSIaC: Toward Security-Aware Infrastructure-as-Code Generation with Large Language Models

Yikun Li, Matteo Grella, Daniel Nahmias, Gal Engelberg, Dan Klein, Giancarlo Guizzardi, Thijs van Ede, Andrea Continella

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04604 2025-11-18 cs.SE 88%

Contrastive Learning-Enhanced Large Language Models for Monolith-to-Microservice Decomposition

Khaled Sellami, Mohamed Aymen Saied

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02001 2025-11-11 cs.DC 88%

EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models

Han Liu, Ruoyao Wen, Srijith Nair, Jia Liu, Wenjing Lou, Chongjie Zhang, William Yeoh, Yevgeniy Vorobeychik, Ning Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00011 2025-10-28 eess.SP 88%

Movable Antenna Enhanced Federated Fine-Tuning of Large Language Models via Hybrid Client Selection Optimization

Yang Zhao, Yue Xiu, Chengxiao Dai, Ning Wei, Dusit Niyato

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17274 2025-10-21 cs.CV 88%

Enhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models

Katie Luo, Jingwei Ji, Tong He, Runsheng Xu, Yichen Xie, Dragomir Anguelov, Mingxing Tan

机构 * Computer and Information Sciences Department, Cornell University(康奈尔大学计算机与信息科学系) Waymo LLC(Waymo公司) UC Berkeley(伯克利大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments In proceedings of IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09078 2025-09-30 cs.SE 88%

An Exploratory Study on Fine-Tuning Large Language Models for Secure Code Generation

Junjie Li, Fazle Rabbi, Cheng Cheng, Aseem Sangalay, Yuan Tian, Jinqiu Yang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments 37 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19755 2025-09-25 cs.SD eess.AS 88%

Can Audio Large Language Models Verify Speaker Identity?

Yiming Ren, Xuenan Xu, Baoxiang Li, Shuai Wang, Chao Zhang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanjing University(南京大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20168 2025-09-23 cs.CV 88%

Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models

Zhentao He, Can Zhang, Ziheng Wu, Zhenghao Chen, Yufei Zhan, Yifan Li, Zhao Zhang, Xian Wang, Minghui Qiu

机构 * ByteDance(字节跳动) CASIA(中国科学院自动化研究所) RUC(中国人民大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16149 2025-09-22 cs.CV 88%

Pointing to a Llama and Call it a Camel: On the Sycophancy of Multimodal Large Language Models

Renjie Pi, Kehao Miao, Li Peihang, Runtao Liu, Jiahui Gao, Jipeng Zhang, Xiaofang Zhou

机构 * HKUST(香港科技大学) HKU(香港大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14373 2025-09-19 cs.SE 88%

CodeLSI: Leveraging Foundation Models for Automated Code Generation with Low-Rank Optimization and Domain-Specific Instruction Tuning

Huy Le, Phong Nguyen, Hao Do, Tuan Nguyen, Thien Pham, Anh Nguyen-Duc, Tho Quan

专题命中 指令微调 :foundation model(title,abstract);instruction tuning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07084 2025-09-12 cs.RO 88%

DriveSOTIF: Advancing Perception SOTIF Through Multimodal Large Language Models

Shucheng Huang, Freda Shi, Chen Sun, Jiaming Zhong, Minghao Ning, Yufeng Yang, Yukun Lu, Hong Wang, Amir Khajepour

机构 * MVSLab, Department of Mechanical and Mechatronics Engineering, University of Waterloo(滑铁卢大学机械与机电工程系MVSLab) CompLING Lab, David R. Cheriton School of Computer Science, University of Waterloo(滑铁卢大学大卫·R·切里顿计算机科学学院CompLING Lab) Department of Data and Systems Engineering, University of Hong Kong(香港大学数据与系统工程系) Department of Mechanical Engineering, University of New Brunswick(新不伦瑞克大学机械工程系) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments This work has been accepted to IEEE Transactions on Vehicular Technology. Please refer to the copyright notice for additional information

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03730 2025-09-08 cs.AI cs.CL cs.CY cs.LG stat.ML 88%

The Personality Illusion: Revealing Dissociation Between Self-Reports & Behavior in LLMs

Pengrui Han, Rafal Kocielnik, Peiyang Song, Ramit Debnath, Dean Mobbs, Anima Anandkumar, R. Michael Alvarez

机构 * Caltech(加州理工学院) UIUC(伊利诺伊大学) University of Cambridge(剑桥大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments We make public all code and source data at https://github.com/psychology-of-AI/Personality-Illusion for full reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00806 2025-09-03 cs.CL cs.AI cs.LG 88%

CaresAI at BioCreative IX Track 1 -- LLM for Biomedical QA

Reem Abdel-Salam, Mary Adewunmi, Modinat A. Abayomi

机构 * Cairo University, Faculty of Engineering, Computer Engineering Department(开罗大学工程学院计算机工程系) Menzies School of Health Research, Charles Darwin University, NT, Australia(梅恩兹健康研究学院,查尔斯达尔文大学,澳大利亚NT) Department of Biology, Boston College, Massachusetts, USA(生物学系,波士顿学院,马萨诸塞州,美国) Peoples' Friendship University of Russia (RUDN University)(俄罗斯人民友谊大学(RUDN大学)) Joint Institute for Nuclear Research(联合核研究中心) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Skövde(斯德哥尔摩大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.AI、cs.LG

Comments Proceedings of the BioCreative IX Challenge and Workshop (BC9): Large Language Models for Clinical and Biomedical NLP at the International Joint Conference on Artificial Intelligence (IJCAI), Montreal, Canada, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏