arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-16 至 2026-02-16 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 19 篇

2508.08275 2026-02-16 cs.CL cs.AI 89%

MLLM-CTBench: A Benchmark for Continual Instruction Tuning with Reasoning Process Diagnosis

MLLM-CTBench: 一个用于持续指令微调的基准,包含推理过程诊断

Haiyun Guo, Zhiyan Hou, Yandu Sun, Jinghan He, Yu Chen, Yuzhe Zhou, Yuheng Jia, Jinqiao Wang, Tat-Seng Chua

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Southeast University(东南大学) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 MLLM-CTBench提出一个用于持续指令微调的基准,通过多维评估框架和强化微调方法,分析跨任务知识保留和灾难性遗忘问题。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00004 2026-02-16 cs.AI cs.CL cs.LG 89%

Finetuning Large Language Models for Automated Depression Screening in Nigerian Pidgin English: GENSCORE Pilot Study

基于大型语言模型的尼日利亚皮钦英语自动化抑郁症筛查:GENSCORE试点研究

Isaac Iyinoluwa Olufadewa, Miracle Ayomikun Adesina, Ezekiel Ayodeji Oladejo, Uthman Babatunde Usman, Owen Kolade Adeniyi, Matthew Tolulope Olawoyin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究利用微调的大型语言模型,针对尼日利亚皮钦英语开发自动化抑郁症筛查工具,GPT-4.1在准确率和文化适应性上表现最佳,为资源受限地区心理健康应用提供基础。

Comments 10 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12561 2026-02-16 cs.CV 89%

PLLM: Pseudo-Labeling Large Language Models for CAD Program Synthesis

PLLM:基于伪标签的大型语言模型用于CAD程序合成

Yuanbo Li, Dule Shu, Yanying Chen, Matt Klenk, Daniel Ritchie

机构 * Brown University(布朗大学) Toyota Research Institute(丰田研究机构)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PLLM通过伪标签技术,利用预训练的大语言模型和未标记的3D形状数据,提升CAD程序合成的几何保真度和程序多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07282 2026-02-16 cs.CL 88%

RAISE: Reinforced Adaptive Instruction Selection For Large Language Models

RAISE: 增强适应性指令选择用于大语言模型

Qingsong Lv, Yangning Li, Zihua Lan, Zishan Xu, Jiwei Tang, Tingwei Lu, Yinghui Li, Wenhao Jiang, Hong-Gee Kim, Hai-Tao Zheng, Philip S. Yu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) University of Illinois Chicago(伊利诺伊大学香槟分校) Seoul National University(首尔国立大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 RAISE通过强化学习动态选择指令,提升大语言模型微调效率与效果。

Comments Accepted by EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12419 2026-02-16 cs.AI 88%

Intent-Driven Smart Manufacturing Integrating Knowledge Graphs and Large Language Models

意图驱动的智能制造整合知识图谱和大语言模型

Takoua Jradi, John Violos, Dimitrios Spatharakis, Lydia Mavraidi, Ioannis Dimolitsas, Aris Leivadeas, Symeon Papavassiliou

机构 * 1Department of Software IT Engineering, École de technologie supérieure, Montreal, Canada 2School of Electrical \& Computer Engineering, National Technical University of Athens

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出结合大语言模型和知识图谱的意图驱动智能制造框架,通过微调和语义映射提升制造系统的人机交互性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16981 2026-02-16 cs.CR 88%

SmartGuard: Leveraging Large Language Models for Network Attack Detection through Audit Log Analysis and Summarization

SmartGuard: 借助大语言模型通过审计日志分析与总结进行网络攻击检测

Hao Zhang, Shuo Shao, Song Li, Zhenyu Zhong, Yan Liu, Zhan Qin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 SmartGuard通过结合抽象行为与大语言模型,实现基于审计日志的网络攻击检测,具有高准确率和良好的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12284 2026-02-16 cs.CL cs.AI cs.LG 87%

A Lightweight LLM Framework for Disaster Humanitarian Information Classification

轻量级LLM框架用于灾难人道主义信息分类

Han Jinzhen, Kim Jisung, Yang Jong Soo, Yun Hong Sik

机构 * Department of Civil, Architectural & Environment Engineering, Sungkyunkwan University(苏州市立大学土木、建筑与环境工程系) School of Geography, University of Leeds(利兹大学地理学院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出轻量级LLM框架,通过参数高效微调实现灾难推文的人道主义信息分类和事件类型识别,展示LoRA和QLoRA在资源受限环境下的高效性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04103 2026-02-16 cs.AI cs.LG stat.ML 86%

How to Train Your LLM Web Agent: A Statistical Diagnosis

如何训练你的LLM网络代理:一种统计诊断

Dheeraj Vattikonda, Santhoshi Ravichandran, Emiliano Penaloza, Hadi Nekoei, Megh Thakkar, Thibault Le Sellier de Chezelles, Nicolas Gontier, Miguel Muñoz-Mármol, Sahar Omidi Shayegan, Stefania Raimondo, Xue Liu, Alexandre Drouin, Laurent Charlin, Alexandre Piché, Alexandre Lacoste, Massimo Caccia

机构 * ServiceNow AI Research(ServiceNow人工智能研究) Mila-Quebec AI Institute(魁北克人工智能研究所) McGill University(麦吉尔大学)

专题命中 指令微调 :LLM(title,abstract);post-training(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于统计的计算分配方法,通过结合监督微调与基于策略的强化学习,有效提升LLM网络代理性能,减少计算成本,缩小与闭源模型的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13073 2026-02-16 cs.LG cs.CL 84%

LCSB: Layer-Cyclic Selective Backpropagation for Memory-Efficient On-Device LLM Fine-Tuning

LCSB: 用于设备端大语言模型微调的内存高效层循环选择反向传播

Juneyoung Park, Eunbeen Yoon, Seongwan Kim. Jaeho Lee

机构 * Opt-AI Inc.(Opt-AI公司)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 LCSB通过选择性梯度计算提升设备端大语言模型微调的效率和稳定性。

Comments Under the review, 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12662 2026-02-16 cs.AI cs.CL 84%

Think Fast and Slow: Step-Level Cognitive Depth Adaptation for LLM Agents

快速思考与缓慢思考:面向LLM代理的步骤级认知深度适应

Ruihan Yang, Fanghua Ye, Xiang We, Ruoqing Zhao, Kang Luo, Xinbo Xu, Bo Zhao, Ruotian Ma, Shanyi Wang, Zhaopeng Tu, Xiaolong Li, Deqing Yang, Linus

机构 * Fudan University(复旦大学) Tencent Hunyuan(腾讯文恩)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 CogRouter通过动态调整认知深度提升LLM代理在多轮决策任务中的性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01239 2026-02-16 eess.IV cs.CV 78%

Can Foundation Models Really Segment Tumors? A Benchmarking Odyssey in Lung CT Imaging

基础模型真的能分割肿瘤吗?在肺部CT成像中的基准测试之旅

Elena Mulero Ayllón, Massimiliano Mantegna, Linlin Shen, Paolo Soda, Valerio Guarrasi, Matteo Tortora

机构 * College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学) Department of Naval, Electrical, Electronics and Telecommunications Engineering, University of Genoa(海军、电气、电子与电信工程部门,热那亚大学)

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本研究评估了基础模型在肺部CT肿瘤分割中的性能,发现MedSAM~2在精度和效率上优于传统模型,展示了其在临床应用中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12709 2026-02-16 cs.CL 77%

ReFilter: Improving Robustness of Retrieval-Augmented Generation via Gated Filter

ReFilter:通过门控过滤提升检索增强生成的鲁棒性

Yixin Chen, Ying Xiong, Shangyu Wu, Xiangrui Ke, Nan Guan, Chun Jason Xue

机构 * City University of Hong Kong(香港城市大学) University of Waterloo(滑铁卢大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ReFilter通过门控过滤提升检索增强生成的鲁棒性,实现跨领域问答任务的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07263 2026-02-16 cs.LG 70%

tLoRA: Efficient Multi-LoRA Training with Elastic Shared Super-Models

tLoRA: 一种高效的多LoRA训练方法与弹性共享超模型

Kevin Li, Dibyadeep Saha, Avni Kanodia, Fan Lai

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Siebel School of Computing and Data Science(计算与数据科学学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 tLoRA通过弹性共享超模型实现多LoRA任务高效训练,提升吞吐量和GPU利用率

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14381 2026-02-16 cs.AI 70%

SCAN: Semantic Document Layout Analysis for Textual and Visual Retrieval-Augmented Generation

SCAN:面向文本和视觉检索增强生成的语义文档布局分析

Nobuhiro Ueda, Yuyang Dong, Krisztián Boros, Daiki Ito, Takuya Sera, Masafumi Oyamada

机构 * NEC Corporation(日本电报电话株式会社)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SCAN通过语义文档布局分析提升文本和视觉检索增强生成的性能,实验显示在英语和日语数据集上分别提升9.4和10.4个点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04112 2026-02-16 cs.LG cs.AI eess.SP stat.ML 62%

Compressible Dynamics in Deep Overparameterized Low-Rank Learning & Adaptation

深度过参数化低秩学习与适应中的可压缩动力学

Can Yaras, Peng Wang, Laura Balzano, Qing Qu

机构 * Department of Electrical Engineering \& Computer Science, University of Michigan

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出Deep LoRA方法,通过深度过参数化低秩学习与适应中的可压缩动力学,提升语言模型微调效率并减少过拟合。

Comments Accepted at ICML'24 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13013 2026-02-16 cs.CV 50%

Towards Universal Video MLLMs with Attribute-Structured and Quality-Verified Instructions

面向具有属性结构和质量验证指令的通用视频MLLMs

Yunheng Li, Hengrui Zhang, Meng-Hao Guo, Wenzhao Gao, Shaoyong Jia, Shaohui Jiao, Qibin Hou, Ming-Ming Cheng

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) ByteDance Inc.(字节跳动公司) Tsinghua University(清华大学)

专题命中 指令微调 :SFT(abstract)

AI总结 本研究提出ASID-1M数据集、ASID-Verify验证流程和ASID-Captioner模型,通过细粒度结构化指令提升视频理解性能,实现高质量描述生成与指令遵循。

Comments Project page: https://asid-caption.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24343 2026-02-16 math.DS cs.IT math.IT math.LO 50%

Parametrized complexity of relations between multidimensional subshifts

多维子移位之间关系的参数复杂性

Nicanor Carrasco-Vargas, Benjamin Hellouin de Menibus, Rémi Pallen

专题命中 指令微调 :SFT(abstract)

AI总结 本文研究了多维子移位之间关系的参数复杂性,发现某些参数选择使问题达到最大难度,并揭示了多维SFT中非平凡可判定问题的存在。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12461 2026-02-16 cs.CV 50%

Semantic-aware Adversarial Fine-tuning for CLIP

语义感知对抗微调用于CLIP

Jiacheng Zhang, Jinhao Li, Hanxun Huang, Sarah M. Erfani, Benjamin I. P. Rubinstein, Feng Liu

机构 * School of Computing and Information Systems(计算机与信息系统学院) The University of Melbourne(墨尔本大学)

专题命中 指令微调 :foundation model(abstract)

AI总结 本文提出语义感知对抗微调方法,通过生成语义感知的对抗性示例提升CLIP模型在零样本分类任务中的对抗鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21370 2026-02-16 cs.RO cs.CV 50%

Language-in-the-Loop Culvert Inspection on the Erie Canal

Erie运河的循环检测

Yash Turkar, Yashom Dighe, Karthik Dantu

机构 * Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学)

专题命中 指令微调 :language model(abstract)

AI总结 VISION通过结合视觉-语言模型和受限视角规划,实现Erie运河涵洞的自主检测,生成高分辨率图像并提升专家评估一致性。

Comments First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏