arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2512.22165 2025-12-30 cs.SD 75%

Marco-ASR: A Principled and Metric-Driven Framework for Fine-Tuning Large-Scale ASR Models for Domain Adaptation

Marco-ASR:一种基于度量驱动的、原则性的框架,用于对大规模ASR模型进行领域适应的微调

Xuanfan Ni, Fei Yang, Fengping Tian, Qingjuan Li, Chenyang Lyu, Yichao Du, Longyue Wang, Weihua Luo, Kaifu Zhang

机构 * Alibaba International Digital Commerce(阿里巴巴国际数字商业)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 Marco-ASR通过基于度量驱动的学习率优化和领域特定数据增强,提升大规模ASR模型在领域适应中的性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05107 2025-12-25 cs.RO 75%

STARE-VLA: Progressive Stage-Aware Reinforcement for Fine-Tuning Vision-Language-Action Models

STARE-VLA:渐进式阶段感知强化用于视觉-语言-动作模型微调

Feng Xu, Guangyao Zhai, Xin Kong, Tingzhong Fu, Daniel F. N. Gordon, Xueli An, Benjamin Busam

机构 * Munich Research Center, Huawei Technologies(慕尼黑研究中心,华为技术)

专题命中 指令微调 :large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 STARE-VLA通过渐进式阶段感知强化方法,提升视觉-语言-动作模型的动作准确性,实现SimplerEnv和ManiSkill3任务中的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20634 2025-12-25 cs.LG cs.AI cs.CL 75%

Real Time Detection and Quantitative Analysis of Spurious Forgetting in Continual Learning

持续学习中虚假遗忘的实时检测与定量分析

Weiwei Wang

机构 * Shenzhen Sunline Tech Co., Ltd.(深圳Sunline科技有限公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出浅层与深层对齐框架,通过定量指标和实时检测方法解决持续学习中的虚假遗忘问题,提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01384 2025-12-19 stat.ML cs.AI cs.CL cs.LG 75%

Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods

使用策略梯度方法微调离散扩散模型

Oussama Zekri, Nicolas Boullé

专题命中 指令微调 :language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SEPO算法,用于高效微调离散扩散模型,通过理论支持和实验验证展示了其在非可微奖励下的有效性。

Comments 33 pages, 8 figures, 8 tables

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14666 2025-12-17 cs.RO cs.CV 75%

EVOLVE-VLA: Test-Time Training from Environment Feedback for Vision-Language-Action Models

EVOLVE-VLA: 通过环境反馈进行测试时训练以实现视觉-语言-动作模型

Zechen Bai, Chen Gao, Mike Zheng Shou

机构 * Show Lab National University of Singapore(新加坡国立大学Show实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 EVOLVE-VLA通过环境反馈实现测试时训练,使视觉-语言-动作模型能持续适应,提升任务性能并实现跨任务泛化。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02629 2025-12-16 cs.SE 75%

Parameter-Efficient Fine-Tuning with Attributed Patch Semantic Graph for Automated Patch Correctness Assessment

基于属性补丁语义图的参数高效微调用于自动补丁正确性评估

Zhenyu Yang, Jingwen Wu, Zhen Yang, Zhongxing Yu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于属性补丁语义图的参数高效微调方法,用于提升自动补丁正确性评估的准确性和F1分数。

Comments 20 pages, 5 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00846 2025-12-12 cs.CV 75%

AFRAgent : An Adaptive Feature Renormalization Based High Resolution Aware GUI agent

AFRAgent:一种基于自适应特征归一化的高分辨率感知GUI代理

Neeraj Anand, Rishabh Jain, Sohan Patnaik, Balaji Krishnamurthy, Mausoom Sarkar

机构 * Media and Data Science Research, Adobe(Adobe媒体与数据科学研究所)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AFRAgent通过自适应特征归一化技术,在保持高分辨率细节的同时,实现了更高效的GUI自动化性能,比现有模型小四分之一。

Comments Accepted at WACV 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08223 2025-12-10 cs.CV 75%

SOP^2: Transfer Learning with Scene-Oriented Prompt Pool on 3D Object Detection

SOP²:基于场景导向提示池的3D目标检测迁移学习

Ching-Hung Cheng, Hsiu-Fu Wu, Bing-Chen Wu, Khanh-Phong Bui, Van-Tin Luu, Ching-Chun Huang

机构 * National Yang Ming Chiao Tung University(国家阳明交通大学) Internet of Things Laboratory(物联网实验室) Chunghwa Telecom Laboratories(中华电信实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出SOP²,一种基于场景导向提示池的3D目标检测迁移学习方法,旨在提升模型在不同场景下的适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02833 2025-11-27 cs.CR 75%

Attack via Overfitting: 10-shot Benign Fine-tuning to Jailbreak LLMs

通过过拟合攻击:10次良性微调以劫持LLMs

Zhixin Xie, Xurui Song, Jun Luo

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 通过10个良性QA对微调实现LLM劫持,利用过拟合增强敏感性,提升攻击效果与隐蔽性。

Comments Published as a conference paper at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07523 2025-11-25 cs.CL cs.AI cs.LG 75%

DemoShapley: Valuation of Demonstrations for In-Context Learning

DemoShapley:为上下文学习评估演示

Shan Xie, Man Luo, Chadly Daniel Stern, Mengnan Du, Lu Cheng

机构 * Department of Mathematics and Computer Science(数学与计算机科学系) Eindhoven University of Technology(埃因霍温理工大学) Intel Lab(英特尔实验室) Department of Psychology(心理学系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Department of Data Science(数据科学系) New Jersey Institute of Technology(新泽西理工学院) Department of Computer Science(计算机科学系) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DemoShapley通过Shapley值评估演示贡献,Beta-DemoShapley优化低样本场景,提升ICL演示评估的鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12639 2025-11-18 cs.CV 75%

Medical Knowledge Intervention Prompt Tuning for Medical Image Classification

Ye Du, Nanxi Yu, Shujun Wang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments IEEE Transactions on Medical Imaging (Early Access) July 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11119 2025-11-17 cs.CV 75%

Stroke Modeling Enables Vectorized Character Generation with Large Vectorized Glyph Model

Xinyue Zhang, Haolong Li, Jiawei Ma, Chen Ye

机构 * Tongji University(同济大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01812 2025-11-17 cs.CL cs.AI cs.LG 75%

$\textit{New News}$: System-2 Fine-tuning for Robust Integration of New Knowledge

Core Francisco Park, Zechen Zhang, Hidenori Tanaka

机构 * Harvard University(哈佛大学) CBS-NTT Program in Physics of Intelligence(物理智能CBS-NTT项目) Center for Brain Science(脑科学中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11880 2025-11-17 cs.LG cs.AI cs.CL 75%

FedALT: Federated Fine-Tuning through Adaptive Local Training with Rest-of-World LoRA

Jieming Bian, Lei Wang, Letian Zhang, Jie Xu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08555 2025-11-12 cs.FL 75%

RESTL: Reinforcement Learning Guided by Multi-Aspect Rewards for Signal Temporal Logic Transformation

Yue Fang, Jin Zhi, Jie An, Hongshen Chen, Xiaohong Chen, Naijun Zhan

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07924 2025-11-12 cs.SE 75%

Testing Question Answering Software with Context-Driven Question Generation

Shuang Liu, Zhirun Zhang, Jinhao Dong, Zan Wang, Qingchao Shen, Junjie Chen, Wei Lu, Xiaoyong Du

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18452 2025-11-11 cs.SD eess.AS 75%

DIFFA: Large Language Diffusion Models Can Listen and Understand

Jiaming Zhou, Hongjie Chen, Shiwan Zhao, Jian Kang, Jie Li, Enzhi Wang, Yujie Guo, Haoqin Sun, Hui Wang, Aobo Kong, Yong Qin, Xuelong Li

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16888 2025-11-05 cs.CV 75%

Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback

Zongjian Li, Zheyuan Liu, Qihui Zhang, Bin Lin, Feize Wu, Shenghai Yuan, Zhiyuan Yan, Yang Ye, Wangbo Yu, Yuwei Niu, Shaodong Wang, Xinhua Cheng, Li Yuan

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23473 2025-10-28 cs.CV 75%

Video-Thinker: Sparking "Thinking with Videos" via Reinforcement Learning

Shijian Wang, Jiarui Jin, Xingjian Wang, Linxin Song, Runhao Fu, Hecheng Wang, Zongyuan Ge, Yuan Lu, Xuelian Cheng

机构 * Southeast University(东南大学) Monash University(墨尔本大学) Xiaohongshu Inc.(小红书公司) University of Southern California(南加州大学) Fudan University(复旦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23397 2025-10-28 cs.CV 75%

VideoTG-R1: Boosting Video Temporal Grounding via Curriculum Reinforcement Learning on Reflected Boundary Annotations

Lu Dong, Haiyu Zhang, Han Lin, Ziang Yan, Xiangyu Zeng, Hongjie Zhang, Yifei Huang, Yi Wang, Zhen-Hua Ling, Limin Wang, Yali Wang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12171 2025-10-27 cs.LG cs.AI cs.CL 75%

GoRA: Gradient-driven Adaptive Low Rank Adaptation

Haonan He, Peng Ye, Yuchen Ren, Yuan Yuan, Luyang Zhou, Shucun Ju, Lei Chen

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Intelligent Machines, HFIPS, Chinese Academy of Sciences(中国科学院智能机械研究所) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) University of Sydney(悉尼大学) Anhui Disaster Warning & Agrometeorological Information Center(安徽省灾害预警与农业气象信息中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19336 2025-10-23 cs.CV 75%

DaMo: Data Mixing Optimizer in Fine-tuning Multimodal LLMs for Mobile Phone Agents

Kai Shi, Jun Yang, Ni Yang, Binqiang Pan, Qingsong Xie, Chao Zhang, Zhenyu Yang, Tianhuang Su, Haonan Lu

机构 * OPPO AI Center(OPPO人工智能中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18484 2025-10-22 cs.CR 75%

The Attribution Story of WhisperGate: An Academic Perspective

Oleksandr Adamov, Anders Carlsson

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Virus Bulletin Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17354 2025-10-21 cs.CL cs.AI cs.IR cs.LG 75%

Towards Mixed-Modal Retrieval for Universal Retrieval-Augmented Generation

Chenghao Zhang, Guanting Dong, Xinyu Yang, Zhicheng Dou

机构 * Renmin University of China(中国人民大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This work is in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01879 2025-10-21 cs.MM cs.CV cs.SD eess.AS 75%

Nexus: An Omni-Perceptive And -Interactive Model for Language, Audio, And Vision

Che Liu, Yingji Zhang, Dong Zhang, Weijie Zhang, Chenggong Gong, Yu Lu, Shilin Zhou, Ziliang Gan, Ziao Wang, Haipang Wu, Ji Liu, André Freitas, Qifan Wang, Zenglin Xu, Rongjuncheng Zhang, Yong Dai

机构 * Imperial College London(伦敦帝国学院) University of Manchester(曼彻斯特大学) HiThink Research(HiThink研究院) Soochow University(苏州大学) Hong Kong Baptist University(香港 Baptist大学) Idiap Research Institute(Idiap研究 institute) Meta AI Fudan University(复旦大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Project: https://github.com/HiThink-Research/NEXUS-O

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15964 2025-10-21 cs.LG cs.AI cs.CL 75%

Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity

Tuowei Wang, Kun Li, Zixu Hao, Donglin Bai, Ju Ren, Yaoxue Zhang, Ting Cao, Mao Yang

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Proceedings of the International Conference for High Performance Computing, Networking, Storage and Analysis, SC 2024, IEEE Press, Article 75, pp. 1-18, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15738 2025-10-17 cs.CR cs.AI cs.CL cs.LG 75%

Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses

Xiaoxue Yang, Bozhidar Stevanoski, Matthieu Meeus, Yves-Alexandre de Montjoye

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12798 2025-10-15 cs.CV 75%

Detect Anything via Next Point Prediction

Qing Jiang, Junan Huo, Xingyu Chen, Yuda Xiong, Zhaoyang Zeng, Yihao Chen, Tianhe Ren, Junzhi Yu, Lei Zhang

机构 * International Digital Economy Academy (IDEA)(国际数字经济学院(IDEA))

专题命中 指令微调 :post-training(abstract);SFT(abstract);prompting(abstract)

Comments homepage: https://rex-omni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01342 2025-10-10 cs.CR 75%

Fine-Tuning Jailbreaks under Highly Constrained Black-Box Settings: A Three-Pronged Approach

Xiangfang Li, Yu Wang, Bo Li

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21653 2025-10-08 cs.CV 75%

Think Before You Diffuse: Infusing Physical Rules into Video Diffusion

Ke Zhang, Cihan Xiao, Jiacong Xu, Yiqun Mei, Vishal M. Patel

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏