arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11667 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11667 篇

2410.01610 2024-10-04 cs.CL cs.AI cs.LG 88%

Upcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging

Tingfeng Hui, Zhenyu Zhang, Shuohuan Wang, Yu Sun, Hua Wu, Sen Su

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19817 2024-10-01 cs.LG cs.AI cs.CL 88%

Calibrating Language Models with Adaptive Temperature Scaling

Johnathan Xie, Annie S. Chen, Yoonho Lee, Eric Mitchell, Chelsea Finn

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);RLHF(abstract)

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13884 2024-09-24 cs.CL cs.AI cs.CY cs.LG 88%

A Multi-LLM Debiasing Framework

Deonna M. Owens, Ryan A. Rossi, Sungchul Kim, Tong Yu, Franck Dernoncourt, Xiang Chen, Ruiyi Zhang, Jiuxiang Gu, Hanieh Deilamsalehy, Nedim Lipka

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18676 2024-07-19 cs.CL cs.AI cs.LG 88%

Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation

Guanting Dong, Yutao Zhu, Chenghao Zhang, Zechen Wang, Zhicheng Dou, Ji-Rong Wen

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05519 2024-06-26 cs.AI cs.CL cs.LG 88%

NExT-GPT: Any-to-Any Multimodal LLM

Shengqiong Wu, Hao Fei, Leigang Qu, Wei Ji, Tat-Seng Chua

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ICML 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10110 2024-06-11 cs.CL cs.AI cs.LG 88%

Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning

Ming Li, Lichang Chen, Jiuhai Chen, Shwai He, Jiuxiang Gu, Tianyi Zhou

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ACL2024 (findings), Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01633 2024-06-05 cs.IR cs.AI cs.CL cs.LG 88%

On Overcoming Miscalibrated Conversational Priors in LLM-based Chatbots

Christine Herlihy, Jennifer Neville, Tobias Schnabel, Adith Swaminathan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint of UAI'24 conference publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05612 2024-05-30 cs.LG cs.AI cs.CL 88%

Unfamiliar Finetuning Examples Control How Language Models Hallucinate

Katie Kang, Eric Wallace, Claire Tomlin, Aviral Kumar, Sergey Levine

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01854 2024-05-22 cs.CL cs.AI cs.LG 88%

Multilingual Instruction Tuning With Just a Pinch of Multilinguality

Uri Shaham, Jonathan Herzig, Roee Aharoni, Idan Szpektor, Reut Tsarfaty, Matan Eyal

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00907 2024-01-03 cs.LG cs.AI cs.CL 88%

LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models

Qianxi Li, Yingyue Cao, Jikun Kang, Tianpei Yang, Xi Chen, Jun Jin, Matthew E. Taylor

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments Paper accepted in Human-Centric Representation Learning workshop at AAAI 2024 (https://hcrl-workshop.github.io/2024/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04087 2023-12-29 cs.CV 88%

SVIT: Scaling up Visual Instruction Tuning

Bo Zhao, Boya Wu, Muyang He, Tiejun Huang

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08485 2023-12-14 cs.CV cs.AI cs.CL cs.LG 88%

Visual Instruction Tuning

Haotian Liu, Chunyuan Li, Qingyang Wu, Yong Jae Lee

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2023 Oral; project page: https://llava-vl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18232 2023-12-01 cs.CL cs.AI cs.LG 88%

LMRL Gym: Benchmarks for Multi-Turn Reinforcement Learning with Language Models

Marwa Abdulhai, Isadora White, Charlie Snell, Charles Sun, Joey Hong, Yuexiang Zhai, Kelvin Xu, Sergey Levine

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);language agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05833 2023-10-02 cs.CL cs.AI cs.LG cs.SE 88%

PACE-LM: Prompting and Augmentation for Calibrated Confidence Estimation with GPT-4 in Cloud Incident Root Cause Analysis

Dylan Zhang, Xuchao Zhang, Chetan Bansal, Pedro Las-Casas, Rodrigo Fonseca, Saravan Rajmohan

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01206 2026-07-13 cs.CL cs.LG 版本更新 88%

RELISH: LLM REgression with a Latent Iterative State Head

基于潜在迭代状态头的大型语言模型回归

Yiheng Su, Matthew Lease

专题命中 指令微调 :LLM(title,abstract);language model(abstract,comments);large language model(abstract);分类 cs.CL、cs.LG

AI总结 RElish通过迭代优化潜在状态实现文本回归,优于三种主流回归方法,参数效率高。

Comments Accepted to the Third Conference on Language Modeling (COLM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08873 2026-08-26 cs.AI 版本更新 88%

UCO: A Multi-Turn Interactive Reinforcement Learning Method for Adaptive Teaching with Large Language Models

UCO:一种用于基于大语言模型的自适应教学的多轮交互强化学习方法

Shouang Wei, Min Zhang, Xin Lin, Bo Jiang, Kun Kuang, Zhongxiang Dai

机构 * East China Normal University(东华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 UCO通过多轮交互强化学习方法,利用进展奖励和支架奖励函数,提升大语言模型在教育场景中的自适应教学能力。

Comments Accepted to EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20360 2026-08-25 cs.AI 版本更新 88%

Evaluating Large Language Models for automatic analysis of teacher simulations

评估用于教师模拟自动分析的大型语言模型

David de-Fitero-Dominguez, Mariano Albaladejo-González, Antonio Garcia-Cabot, Eva Garcia-Lopez, Antonio Moreno-Cediel, Erin Barno, Justin Reich

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 该研究评估了DeBERTaV3、Llama 3等LLMs在教师教育数字模拟响应特征识别中的性能,发现Llama 3检测新特征更稳定,可为相关自动评估研究提供指导。

Comments Final published version in the Heliyon journal. Volume 12, Issue 14, September 2026, e45323. DOI: https://doi.org/10.1016/j.heliyon.2026.e45323

Journal ref Heliyon (September 2026), Volume 12, Issue 14, e45323

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19680 2026-08-21 cs.AI 新提交 88%

Frequency-Aware Continual Learning for Smart Contract Vulnerability Detection with Large Language Models

基于大语言模型的频率感知持续学习智能合约漏洞检测

Tenghui Huang, Jiawen Kang, Dongning Liu, Changyan Yi, Chengjun Cai, Anjia Yang, Li Li, Dong In Kim

机构 * School of Automation, Guangdong University of Technology(广东工业大学自动化学院) School of Computer Science and Technology, Guangdong University of Technology(广东工业大学计算机科学与技术学院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院) Department of Computer Science, City University of Hong Kong (Dongguan)(香港城市大学(东莞)计算机科学系) College of Cyber Security, Jinan University(暨南大学网络安全学院) Guangdong Institute of Science and Technology Information(广东省科技情报研究所) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电气与计算机工程系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 该研究针对大语言模型用于智能合约漏洞检测时的三个挑战,提出含FA-LoRA、FAR、APPM的三阶段集成框架,在DIVE数据集上取得优异性能,可有效应对区块链生态系统的相关问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15315 2026-08-19 cs.AI 版本更新 88%

ChatPlanner: A Large Language Model Framework for Personalized Public Transit Routing

ChatPlanner: 一个用于个性化公共交通路线规划的大型语言模型框架

Tingting Yang, Chenhao Xue, Jun Chen

机构 * School of Engineering and Materials Science, Queen Mary University of London(伦敦玛丽女王大学工程与材料科学学院) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出ChatPlanner框架,利用大型语言模型和检索增强生成技术从自然语言查询中提取用户偏好并融入路线规划算法,实验证明其能生成更符合个性化需求的可行路线方案。

Comments Under Review at Transportation Research Part C

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14631 2026-08-18 cs.AI 新提交 88%

Accuracy and Reliability of Large Language Models in Cosmetic Chemistry and Skin Health: A Benchmarking Study

大型语言模型在化妆品化学与皮肤健康领域的准确性与可靠性:一项基准测试研究

Amelia Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究测试14个LLMs在化妆品化学与皮肤健康领域的表现,发现其总体准确性差、技术深度不足,无法可靠提供相关信息,需微调验证数据集并改进算法推理。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19612 2026-08-18 cs.CL 88%

Anatomy of Unlearning: The Dual Impact of Fact Salience and Model Fine-Tuning

遗忘的解剖:事实显著性与模型微调的双重影响

Anna Borisiuk, Andrey Savchenko, Alexander Panchenko, Elena Tutubalina

机构 * AIRI Sber AI Lab HSE University(HSE大学) Skoltech ISP RAS Research Center for Trusted Artificial Intelligence(ISP RAS可信人工智能研究中心)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过构建DUET基准,分析了预训练与监督微调阶段的事实显著性对机器遗忘效果的影响,发现微调后的模型遗忘更平滑且保留率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06854 2026-08-14 cs.CL 版本更新 88%

SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks

SEMA: 简单却有效的多轮对抗攻击学习

Mingqian Feng, Xiaodong Liu, Weiwei Yang, Jialin Song, Xuekai Zhu, Chenliang Xu, Jianfeng Gao

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 SEMA通过多阶段学习实现高效多轮对抗攻击,无需依赖现有策略,提升攻击成功率并增强安全测试能力。

Comments ICLR 2026, 37 pages, 13 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11030 2026-08-12 cs.IR cs.CL 新提交 88%

Self-Knowledge Retrieval Augmented Generation Framework for Patent Matching

用于专利匹配的自知识检索增强生成框架

Jian Zhang, Songlin Lei, Zhuohao Yang, Bangli Liu, Ziwei Wang, Xufeng Weng, Gehan Amaratunga, Yu Lin, Hongwei Wang

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 针对专利匹配的LLM方法存在成本高、易遗忘等问题,本文提出自知识RAG框架,结合FAISS检索与生成式匹配机制,在真实专利数据集上提升了检索匹配准确率。

Comments Accepted by IEEE CSCWD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10513 2026-08-12 cs.CV cs.AI 新提交 88%

SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning

SafeCap:通过图像字幕强化学习提升大型视觉语言模型(LVLM)的安全性

Caoyuan Ma, Wenpu Liu, Weichu Xie, Tian Gu, Shilei Zhao, Lingxi Min, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng Chang, Taiqiang Wu, Yongfu Zhu, Wenqi Shao, Yinqiang Zheng

专题命中 指令微调 :SFT(summary_cn,abstract);LLM(abstract,abstract_cn);language model(abstract);分类 cs.AI

AI总结 SafeCap是一种通过图像字幕强化学习提升LVLM安全性的框架,在多模态安全基准上安全得分提升3.7-19.0个百分点,且视觉效用相当或更优,性能优于安全SFT等方法。

Comments 16pages, 4 figures. Preprint. Project page: https://safe-vlm.github.io/SafeCap/ ; code: https://github.com/Safe-VLM/SafeCap

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04186 2026-08-07 cs.CL 版本更新 88%

Large Language Models for Low-Resource Languages: A Conceptual Framework for an Electronic Explanatory Dictionary of the Tajik Language

用于低资源语言的大语言模型:塔吉克语电子解释词典的概念框架

Mullosharaf K. Arabov, S. S. Pirov, B. Sultonov

机构 * Kazan Federal University(喀山联邦大学) Tajik National University(塔吉克国立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文针对低资源语言塔吉克语,提出结合LLMs与经典词典方法的电子解释词典概念架构,为相关应用NLP任务提供核心资源,适用于计算语言学等领域从业者。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13227 2026-08-07 cs.CL 版本更新 88%

PolyAlign: Conditional Human-Distribution Alignment

PolyAlign: 条件性人类分布对齐

L. D. M. S. Sai Teja, Ufaq Khan, Sathira Silva, Xiao Wu, Muhammad Haris Khan

机构 * NIT Silchar(印度国立理工学院锡尔恰尔分校) MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 指令微调 :SFT(summary_cn,abstract);language model(abstract);post-training(abstract);preference optimization(abstract)

AI总结 提出PolyAlign框架,通过桶感知SFT和人类分布偏好优化,实现语言模型在不同交互上下文中的条件性人类分布对齐,提升自然性和分布忠实度。

Comments 23 pages, 5 Figures, 13 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04440 2026-08-06 q-bio.QM cs.AI 交叉投稿 88%

AutoProteinEngine: A Large Language Model Driven Agent Framework for Multimodal AutoML in Protein Engineering

AutoProteinEngine:一种用于蛋白质工程多模态自动机器学习的大语言模型驱动智能体框架

Yungeng Liu, Zan Chen, Yu Guang Wang, Yiqing Shen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究针对生物学家缺乏计算知识难以应用深度学习开展蛋白质工程的问题,提出AutoProteinEngine框架,集成LLMs与AutoML,经两项任务验证其性能优于传统方法,降低了深度学习应用门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03277 2026-08-05 cs.LG cs.CR 新提交 88%

Noise-Aware Shrinkage for Differentially Private Zeroth-Order Fine-Tuning of Large Language Models

面向大语言模型的差分隐私零阶微调的噪声感知收缩方法

Lele Zheng, Weifeng Kong, Xinyi Zhang, Ke Cheng, Tao Zhang, Yulong Shen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文针对差分隐私零阶微调大语言模型的噪声问题,提出SAGE噪声感知收缩方法,经理论分析和多模型实验验证,该方法在相同隐私预算下多数场景优于基线,且保留内存效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19360 2026-08-04 cs.AI 版本更新 88%

Lifted State Hypothesis in Large Language Models

语言模型中的提升表示假设

Bumjin Park, Jaesik Choi

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究大型语言模型中结构的存储、选择和修正问题,提出提升表示假设,通过多种实验评估其提升和细化情况,发现数据受嵌套规则和异常支配时模型存在问题,强调需研究数据与规则结构关系。

Comments 24 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14340 2026-08-04 cs.CR cs.LG 版本更新 88%

Turn-Based Structural Triggers: Structure-Conditioned Backdoors in Multi-Turn LLMs

基于回合的结构性触发器:多轮LLM中的无提示后门

Yiyang Lu, Jinwen He, Yue Zhao, Kai Chen, Ruigang Liang, Cheng Hong, Yingjun Zhang

机构 * School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Ant Group(蚂蚁集团)

专题命中 指令微调 :LLM(title_cn,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 提出一种利用对话结构(回合索引)作为触发器的后门攻击方法TST,无需用户输入即可激活,实现高攻击成功率并绕过提示中心防御。

详情

展开后加载摘要…

URL PDF HTML 收藏