arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-25 至 2025-11-25 共收录 28 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 28 篇

2504.05321 2025-11-25 cs.IR cs.AI cs.LG 91%

VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search

VALUE: 用于通过加权前缀树进行查询重写的值感知大语言模型

Xiao Zhang, Guanyu Chen, Boyang Zuo, Feng Li, Pengjie Wang, Jian Xu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

AI总结 VALUE通过加权前缀树整合价值感知,提升搜索引擎广告中查询重写的语义相关性和商业价值

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19417 2025-11-25 cs.CL cs.AI cs.LG 89%

Be My Eyes: Extending Large Language Models to New Modalities Through Multi-Agent Collaboration

Be My Eyes: 通过多智能体协作扩展大型语言模型到新模态

James Y. Huang, Sheng Zhang, Qianchu Liu, Guanghui Qin, Tinghui Zhu, Tristan Naumann, Muhao Chen, Hoifung Poon

机构 * University of Southern California(南加州大学) Microsoft Research(微软研究院) University of California, Davis(加州大学戴维斯分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BeMyEyes通过多智能体协作扩展LLMs到多模态推理,利用高效VLMs与强大LLMs的互补优势,实现轻量级开源解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18823 2025-11-25 cs.CV 89%

VideoPerceiver: Enhancing Fine-Grained Temporal Perception in Video Multimodal Large Language Models

VideoPerceiver: 提升视频多模态大语言模型的细粒度时序感知能力

Fufangchen Zhao, Liao Zhang, Daiqi Shi, Yuanjun Gao, Chen Ye, Yang Cai, Jian Gao, Danfeng Yan

机构 * State Key Laboratory of Networking and Switching Technology, BUPT(网络与交换技术国家重点实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

AI总结 VideoPerceiver通过两阶段训练框架提升视频多模态大语言模型对细粒度动作和短暂事件的感知能力,显著优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02462 2025-11-25 cs.SE cs.AI cs.LG 88%

Parameter-Efficient Fine-Tuning of Large Language Models for Unit Test Generation: An Empirical Study

大型语言模型参数高效微调用于单元测试生成:一项实证研究

André Storhaug, Jingyue Li

机构 * Norwegian University of Science and Technology(挪威科学技术大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过实证研究探讨了大型语言模型在单元测试生成中的参数高效微调方法,发现LoRA在某些情况下性能可与全量微调媲美,提示微调在成本效益上表现最佳。

Comments 26 pages, 2 figures, 6 tables, 1 listing

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22120 2025-11-25 cs.CL 86%

LoKI: Low-damage Knowledge Implanting of Large Language Models

LoKI: 大型语言模型的低损伤知识植入

Runyu Wang, Peng Ping, Zhengyu Guo, Xiaoye Zhang, Quan Shi, Liting Zhou, Tianbo Ji

专题命中 指令微调 :large language model(title);language model(title);pretraining(abstract);分类 cs.CL

AI总结 LoKI通过利用transformer架构的知识存储机制,实现了在保持通用能力的同时提升任务特定性能的参数高效微调方法。

Comments AAAI-26 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12109 2025-11-25 cs.CL cs.AI 86%

Personalized LLM Decoding via Contrasting Personal Preference

通过对比个人偏好实现个性化大语言模型解码

Hyungjune Bu, Chanjoo Jung, Minjae Kang, Jaehyung Kim

机构 * Yonsei University(延世大学) Opt-AI Inc.(Opt-AI公司)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CoPe方法,通过奖励引导解码实现个性化,提升ROUGE-L指标10.57%。

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10390 2025-11-25 eess.SY cs.SY 85%

Self-Refined Generative Foundation Models for Wireless Traffic Prediction

用于无线交通预测的自精炼生成基础模型

Chengming Hu, Hao Zhou, Di Wu, Xi Chen, Jun Yan, Xue Liu

专题命中 指令微调 :foundation model(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出TrafficLLM,通过上下文学习实现无线交通预测,通过三步迭代精炼提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18342 2025-11-25 cs.IR 85%

UFO: Unfair-to-Fair Evolving Mitigates Unfairness in LLM-based Recommender Systems via Self-Play Fine-tuning

UFO: 通过自我对战微调缓解基于大语言模型的推荐系统中的不公平性

Jiaming Zhang, Yuyuan Li, Xiaohua Feng, Zhifei Ren, Li Zhang, Chaochao Chen

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 UFO框架通过自我对战机制,缓解基于大语言模型的推荐系统中的不公平性,同时提升推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07777 2025-11-25 cs.CL cs.AI 84%

Drift No More? Context Equilibria in Multi-Turn LLM Interactions

多轮交互中不再漂移:多轮LLM交互中的上下文均衡

Vardhan Dongre, Ryan A. Rossi, Viet Dac Lai, David Seunghyun Yoon, Dilek Hakkani-Tür, Trung Bui

机构 * Adobe Research(Adobe研究院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出了一种动态框架,通过KL散度和递归模型解释多轮交互中的上下文漂移,展示可控干预能有效减少漂移,表明漂移是可控均衡现象而非必然衰减。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18854 2025-11-25 cs.SE cs.AI 83%

Time Travel: LLM-Assisted Semantic Behavior Localization with Git Bisect

时间旅行:借助Git Bisect的LLM辅助语义行为定位

Yujing Wang, Weize Hong

机构 * University of Waterloo(滑铁卢大学) Brock University(布罗克大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用LLM和Git Bisect进行语义行为定位,通过结构化推理链提升故障定位准确率,实验显示成功率提升6.4个百分点,平均bisect时间减少2倍。

Comments submitted to Git Bisect SCALCOM 2025 Calgary (to be published)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16887 2025-11-25 cs.CR cs.AI cs.LG cs.SE 81%

Revisiting Pre-trained Language Models for Vulnerability Detection

重新审视预训练语言模型用于漏洞检测

Youpeng Li, Weiliang Qi, Xuyu Wang, Fuxun Yu, Xinda Wang

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) Florida International University(佛罗里达国际大学) Microsoft(微软公司)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文重新审视预训练语言模型在漏洞检测中的应用,发现特定设计的模型在性能上更优,但面临现实场景中的挑战,如复杂依赖检测和标注错误问题。

Comments Accepted by the 21st ACM ASIA Conference on Computer and Communications Security (AsiaCCS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16216 2025-11-25 cs.LG cs.AI cs.CL 80%

GMoE: Empowering LLMs Fine-Tuning via MoE Graph Collaboration

GMoE:通过MoE图协作增强LLM微调

Ting Bai, Yue Yu, Le Huang, Zenan Xu, Chuan Shi

机构 * Beijing University of Posts and Telecommunication(北京邮电大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 GMoE通过图协作策略提升LLM微调的稳定性与效率

Comments 9 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18306 2025-11-25 cs.CL 79%

Table Comprehension in Building Codes using Vision Language Models and Domain-Specific Fine-Tuning

利用视觉语言模型和领域特定微调进行建筑规范中的表格理解

Mohammad Aqib, Mohd Hamza, Ying Hei Chui, Qipei Mei

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

AI总结 本文研究了利用视觉语言模型和领域特定微调提取建筑规范中表格信息的方法,发现直接输入方法在准确性上优于间接输入方法,且微调后模型性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17982 2025-11-25 cs.CR cs.AI 79%

Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models

面向图基础模型的高效、隐蔽和持久后门攻击

Jiayi Luo, Qingyun Sun, Lingjuan Lyu, Ziwei Zhang, Haonan Yuan, Xingcheng Fu, Jianxin Li

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

AI总结 本文提出GFM-BA,一种针对图基础模型的高效、隐蔽和持久后门攻击方法,通过无标签触发关联模块、节点自适应触发生成器和持久后门锚定模块解决后门攻击的三大挑战。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19325 2025-11-25 cs.IR cs.AI cs.CL 79%

Generative Query Expansion with Multilingual LLMs for Cross-Lingual Information Retrieval

基于多语言大语言模型的生成式查询扩展用于跨语言信息检索

Olivia Macmillan-Scott, Roksana Goworek, Eda B. Özyiğit

机构 * The Alan Turing Institute(艾伦·图灵研究所) University College London(伦敦大学学院) Queen Mary University of London(伦敦女王学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨了多语言大语言模型在跨语言信息检索中的生成式查询扩展效果,发现查询长度和提示技术对性能影响显著,且不同语言间存在显著的检索性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19261 2025-11-25 cs.CV 78%

LAST: LeArning to Think in Space and Time for Generalist Vision-Language Models

LAST: 为通用视觉-语言模型学习在空间和时间中的思考

Shuai Wang, Daoan Zhang, Tianyi Bai, Shitong Shao, Jiebo Luo, Jiaheng Wei

机构 * HKUST(GZ)(香港科技大学(广州)) University of Rochester(罗切斯特大学)

专题命中 指令微调 :language model(title,abstract)

AI总结 LAST通过学习在空间和时间上思考,提升通用视觉-语言模型对3D空间和长视频的理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18709 2025-11-25 cs.RO 78%

Autonomous Surface Selection For Manipulator-Based UV Disinfection In Hospitals Using Foundation Models

基于基础模型的医院机器人紫外线消毒表面自主选择

Xueyan Oh, Jonathan Her, Zhixiang Ong, Brandon Koh, Yun Hann Tan, U-Xuan Tan

机构 * Engineering Product Development Pillar, Singapore University of Technology and Design, Singapore(新加坡科技设计大学工程产品开发部门) Centre for Healthcare Assistive & Robotics Technology, Singapore(新加坡医疗辅助与机器人技术中心) National Centre for Infectious Diseases, Singapore(新加坡传染病国家中心)

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本研究提出基于基础模型的机器人紫外线消毒表面自主选择方法,通过视觉语言模型辅助分割细化,提高消毒效率并减少误判,实验证明其在实际应用中的有效性。

Comments 7 pages, 7 figures; This paper has been accepted by IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17927 2025-11-25 cs.CV cs.AI 77%

PA-FAS: Towards Interpretable and Generalizable Multimodal Face Anti-Spoofing via Path-Augmented Reinforcement Learning

PA-FAS: 向可解释和通用的多模态人脸反伪装迈进:通过路径增强强化学习

Yingjie Ma, Xun Lin, Yong Xu, Weicheng Xie, Zitong Yu

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 PA-FAS通过路径增强强化学习提升多模态人脸反伪装的可解释性和泛化能力。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07523 2025-11-25 cs.CL cs.AI cs.LG 75%

DemoShapley: Valuation of Demonstrations for In-Context Learning

DemoShapley:为上下文学习评估演示

Shan Xie, Man Luo, Chadly Daniel Stern, Mengnan Du, Lu Cheng

机构 * Department of Mathematics and Computer Science(数学与计算机科学系) Eindhoven University of Technology(埃因霍温理工大学) Intel Lab(英特尔实验室) Department of Psychology(心理学系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Department of Data Science(数据科学系) New Jersey Institute of Technology(新泽西理工学院) Department of Computer Science(计算机科学系) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DemoShapley通过Shapley值评估演示贡献,Beta-DemoShapley优化低样本场景,提升ICL演示评估的鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12609 2025-11-25 cs.CL cs.AI cs.CV 73%

Uni-MoE-2.0-Omni: Scaling Language-Centric Omnimodal Large Model with Advanced MoE, Training and Data

Uni-MoE-2.0-Omni: 通过先进MoE、训练和数据扩展语言导向的多模态大模型

Yunxin Li, Xinyu Chen, Shenyuan Jiang, Haoyuan Shi, Zhenyu Liu, Xuanyu Zhang, Nanhao Deng, Zhenran Xu, Yicheng Ma, Meishan Zhang, Baotian Hu, Min Zhang

机构 * Research Institute of Computing and Intelligence(计算与智能研究 institute) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 指令微调 :LLM(abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 Uni-MoE-2.0-Omni通过先进MoE、训练和数据技术,实现了语言导向的多模态大模型,展现出在多模态理解、推理和生成任务中的卓越性能。

Comments 47 pages,10 Figures, Project Website: https://idealistxy.github.io/Uni-MoE-v2.github.io/ Codes: https://github.com/HITsz-TMG/Uni-MoE

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18039 2025-11-25 cs.LG 70%

Curvature-Aware Safety Restoration In LLMs Fine-Tuning

曲率感知的LLM微调安全恢复

Thong Bach, Thanh Nguyen-Tang, Dung Nguyen, Thao Minh Le, Truyen Tran

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究提出曲率感知对齐恢复方法,通过影响函数和二阶优化,在保持任务性能的同时减少有害输出,提升LLM的安全性和实用性。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17413 2025-11-25 cs.CL 70%

Conversations: Love Them, Hate Them, Steer Them

对话:喜欢它们,讨厌它们,引导它们

Niranjan Chebrolu, Gerard Christopher Yeo, Kokil Jaidka

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过激活工程引导LLaMA 3.1-8B增强情感表达,提升对话AI的共情能力。

Comments We have created a new arXiv submission with a more up to date version of this paper at arXiv:2511.12832

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07189 2025-11-25 cs.SE 67%

Secure-Instruct: An Automated Pipeline for Synthesizing Instruction-Tuning Datasets Using LLMs for Secure Code Generation

Secure-Instruct: 一种利用LLM合成指令微调数据集的自动化流程,用于安全代码生成

Junjie Li, Fazle Rabbi, Bo Yang, Song Wang, Jinqiu Yang

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 Secure-Instruct通过自动化合成安全代码示例和指令微调LLM,提升代码生成的安全性和功能性正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22390 2025-11-25 cs.SE 67%

What Characteristics Make ChatGPT Effective for Software Issue Resolution? An Empirical Study of Task, Project, and Conversational Signals in GitHub Issues

哪些特征使ChatGPT在软件问题解决中有效?对GitHub问题中任务、项目和对话信号的实证研究

Ramtin Ehsani, Sakshi Pathak, Esteban Parra, Sonia Haiduc, Preetha Chatterjee

专题命中 指令微调 :LLM(abstract);language model(abstract)

AI总结 本文研究了ChatGPT在软件问题解决中的有效性特征,发现其在代码生成和工具推荐方面表现较好,但代码解释能力较弱,且更受欢迎的项目和经验丰富的开发者从中受益更多。

Comments Accepted for publication in Empirical Software Engineering (EMSE), 2025

Journal ref Empirical Software Engineering, 31, 22 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13093 2025-11-25 cs.CV cs.AI 57%

Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension

Video-RAG: 基于视觉对齐的检索增强长视频理解

Yongdong Luo, Xiawu Zheng, Guilin Li, Shukang Yin, Haojia Lin, Chaoyou Fu, Jinfa Huang, Jiayi Ji, Fei Chao, Jiebo Luo, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) Nanjing University(南京大学) University of Rochester(罗切斯特大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 Video-RAG通过视觉对齐的辅助文本提升长视频理解性能,无需训练且兼容性强,显著优于专有模型。

Comments Accepted at NeurIPS 2025. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19268 2025-11-25 cs.CV 50%

BideDPO: Conditional Image Generation with Simultaneous Text and Condition Alignment

BideDPO:基于文本和条件对齐的同时图像生成

Dewei Zhou, Mingwei Li, Zongxin Yang, Yu Lu, Yunqiu Xu, Zhizhong Wang, Zeyi Huang, Yi Yang

机构 * Zhejiang University(浙江大学) Harvard University(哈佛大学) Huawei Technologies Ltd., China(华为技术有限公司)

专题命中 指令微调 :preference optimization(abstract)

AI总结 BideDPO通过双向解耦的DPO框架解决文本与条件间的冲突,提升图像生成的准确性和一致性。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18976 2025-11-25 cs.CV 50%

Peregrine: One-Shot Fine-Tuning for FHE Inference of General Deep CNNs

Peregrine: 为通用深度CNN的FHE推理实现一次微调

Huaming Ling, Ying Wang, Si Chen, Junfeng Fan

机构 * Cipherflow Shenzhen, China(Cipherflow深圳分公司) Open Security Research Shenzhen, China(开放安全研究深圳分公司)

专题命中 指令微调 :SFT(abstract)

AI总结 Peregrine通过单阶段微调策略和通用交错打包方案,实现了通用深度CNN的高效FHE推理,支持高分辨率图像处理并首次展示了YOLO架构的FHE推理应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18131 2025-11-25 cs.CV 50%

Video4Edit: Viewing Image Editing as a Degenerate Temporal Process

Video4Edit: 将图像编辑视为一种退化的时间过程

Xiaofan Li, Yanpeng Sun, Chenming Wu, Fan Duan, YuAn Wang, Weihao Bo, Yumeng Zhang, Dingkang Liang

机构 * Baidu Inc.(百度公司)

专题命中 指令微调 :foundation model(abstract)

AI总结 Video4Edit通过将图像编辑视为退化的时间过程,利用视频预训练的单帧演化先验,实现高效的数据微调,从而在性能上与主流模型相当,但仅需1%的监督数据。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏