arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12698 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 1045 篇

2606.09430 2026-06-09 cs.LG cs.AI 新提交 62%

LargeMonitor: Monitoring Online Task-Free Continual Learning via Large Pretrained Models

LargeMonitor: 通过大型预训练模型监控在线无任务持续学习

Mingqi Yuan, Xiaoquan Sun, Shihao Luo, Jiayu Chen

机构 * HKU(香港大学) Qicore Tech(启科科技)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 提出LargeMonitor框架,利用大型预训练模型(LVM和LMM)解耦检测与诊断,实现无任务持续学习中的零样本漂移检测和语义病因诊断,提升现有算法性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06519 2026-06-08 cs.AI cs.LG 新提交 62%

SafeGene: Reusable Adapters for Transferable Safety Alignment

SafeGene: 可重用的适配器实现可迁移的安全对齐

Yanghan Wang, Zhiqiang Kou, Fu Feng, Jing Wang, Xin Geng

机构 * Southeast University(东南大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :LLM(abstract_cn);分类 cs.AI、cs.LG

AI总结 提出SafeGene,一种可重用的安全适配器模块,通过从对齐-退化模型差异中提取安全表示,并利用数据感知层选择和少样本系数重校准,实现跨任务的安全恢复,在保持下游性能的同时降低有害响应率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26594 2026-08-28 cs.LG 新提交 57%

SimCast-S2S: An Efficient Generative Model for Subseasonal Precipitation Forecasting via Transfer Learning from Climate Simulations

SimCast-S2S:一种基于气候模拟迁移学习的高效次季节降水预测生成模型

Hiep V. Dang, Antonios Mamalakis

机构 * University of Virginia(弗吉尼亚大学) School of Data Science(数据科学学院) Department of Environmental Sciences(环境科学系)

专题命中 指令微调 :pretraining(abstract);分类 cs.LG

AI总结 本研究提出SimCast-S2S,一种基于气候模拟迁移学习的潜在扩散生成模型,通过变分自编码器的紧凑潜在空间与LoRA迁移学习,实现高效次季节降水概率预测,性能优于深度学习基线及ECMWF-S2S等业务系统。

Comments Manuscript submitted to Nature Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26060 2026-08-27 cs.CL stat.ML 新提交 57%

Fine-Tuning Whisper for Automatic Speech Recognition in Baniwa: A Preliminary Study

微调Whisper以实现巴尼瓦语的自动语音识别:一项初步研究

Leonardo Duart, Tiago Fonseca, Thiago Chacón

机构 * University of Brasilia(巴西利亚大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.CL

AI总结 本研究对Whisper Small进行微调,构建巴尼瓦语ASR初始基准,证实多语言基础模型可适配资源匮乏的土著语言,为后续相关研究提供支撑。

Comments 12 pages, 3 tables. Preliminary study

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25707 2026-08-27 cs.LG 新提交 57%

Fairness-Aware Test-Time Prompt Tuning

感知公平性的测试时提示调优

Yoann Launay, Parameswaran Kamalaruban, Tom Kempton, Stuart Burrell, David Sutton

机构 * University of Cambridge(剑桥大学) Visa Inc.(维萨公司) University of Manchester(曼彻斯特大学)

专题命中 指令微调 :language model(abstract);分类 cs.LG

AI总结 本文针对分布偏移下视觉-语言模型的公平性问题,提出了感知公平性的情节式测试时自适应方法FairTPT,通过软提示调优联合优化熵,实现公平性提升并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25038 2026-08-27 cs.CL 新提交 57%

Padamitra: Grounded Glossary Generation for Classical Sanskrit

Padamitra:基于 grounded 术语表生成的古典梵语研究

Manoj Balaji Jagadeeshan, Sai Pragnaan Marala, Pawan Goyal

专题命中 指令微调 :prompting(abstract);分类 cs.CL

AI总结 该研究提出 grounded 术语表生成任务,构建含31316个三元组的梵语基准,发现指令微调及显式分词可提升性能,指出形态建模是梵词语法分解的关键瓶颈。

Comments Accepted in the Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24966 2026-08-27 cs.CV cs.AI 新提交 57%

Targeting the Attention Heads Behind Object Hallucination in LLaVA

针对LLaVA中物体幻觉背后的注意力头

Armaan Sandhu, Abhilasha Senapati, Hima Kammachi

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 本研究针对LLaVA的物体幻觉问题,通过注意力头诊断筛选出32个关键注意力头,结合LoRA适配器与推理控制器,在COCO数据集上显著降低了物体幻觉率。

Comments 10 pages, 5 figures, 3 tables. Accepted at the Actionable Interpretability Workshop, COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24133 2026-08-26 cs.CV cs.AI cs.IR 新提交 57%

PlaceSeek: Human-Centered Geospatial Retrieval of Urban Outdoor Places via Semantic Grounding and Affective Alignment

PlaceSeek:通过语义 grounding 与情感对齐实现以人类为中心的城市户外地点地理空间检索

Ziqi Cui, Shangyu Lou

机构 * University of British Columbia(不列颠哥伦比亚大学) University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校) San Diego State University(圣地亚哥州立大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 该研究针对现有地理空间检索难以满足情感/活动类需求的问题,提出 PlaceSeek 框架,通过语义 grounding 与情感对齐实现城市户外地点检索,在米兰数据集上的表现优于多种基线方法。

Comments Accepted as a Research Paper (short) at ACM SIGSPATIAL 2026. This arXiv version is the full version of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23812 2026-08-26 cs.CL 新提交 57%

From Preferences to Principles: Rubric-Based Alignment for Grounded Knowledge Answers

从偏好到原则:基于评分规则的接地知识答案对齐

Aman Saini, Priyanshu Kumar, Eric Peng, Kai Yuan, Harsh Girase, Wanming Chen

机构 * Apple(苹果公司)

专题命中 指令微调 :post-training(abstract);分类 cs.CL

AI总结 本研究针对开放域问答的奖励信号设计难题,提出基于检索证据生成查询特定多维评分规则的奖励框架,经实验验证其比基线方法有显著性能提升,为复杂开放域问答提供更有效的奖励监督。

Comments 18 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23807 2026-08-26 cs.AI 新提交 57%

Serving Masked Diffusion LLMs: Characterization and Design Principles from Real Hardware

部署掩码扩散大语言模型:基于真实硬件的特性分析与设计原则

Farhana Amin, Sabiha Afroz, Mona Moghadampanah, Dimitrios S. Nikolopoulos

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 本文通过真实硬件实验分析LLaDA-8B-Instruct等dLLM的部署特性,发现其请求步数离散、批处理可分摊CPU开销等规律,提出适配dLLM的部署设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21756 2026-08-25 cs.LG cs.CV nucl-ex physics.ins-det 新提交 57%

How Architecture and Training Affect TPC Representations Across Experiments

架构与训练如何影响跨实验的TPC表示

Tyler Wheeler, Michelle P. Kuchera, Raghuram Ramanujan, William Sieland, Ryan Krupp, Daniel Bazin, Connor L. Cross, Hoi Yan Ian Heung, Andrew J. Jones, Ruchi Mahajan, Saiprasad Ravishankar, Pranjal Singh, Benjamin Votaw, Chris Wrede

机构 * Michigan State University(密歇根州立大学) Grand Valley State University(大峡谷州立大学) Davidson College(戴维森学院) University of Kentucky(肯塔基大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 本研究以TPC数据为测试平台,通过冻结编码器的探针方法,发现架构是TPC嵌入中任务相关结构的主要来源,其诱导的表示可跨实验和探测器系统复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21315 2026-08-24 cs.CL 新提交 57%

Prompt-Model Interaction Reaches the Fixed Points: A deterministic, task-free structural readout -- and the factorizations of it that failed

提示-模型交互达到不动点:一种确定性、无任务的结构读出——以及失败的因子分解

Nicolás Vera Zúñiga

专题命中 指令微调 :instruction tuning(abstract);分类 cs.CL

AI总结 该研究针对提示-模型交互的无任务读出,发现9个token的条件可改变不动点结构类别与模型排序,提出的现象学因素无法解释该效应,解释单元为提示-模型对。

Comments 11 pages, 4 tables. Companion to arXiv:2608.10986. Code, per-run results, and the findings ledger: https://github.com/nicoveraz/token-lattice-ca (archived: https://doi.org/10.5281/zenodo.21880472)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21099 2026-08-24 cs.CV cs.AI 新提交 57%

A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration

A2DINOv3:通过社会化协作重新思考多模态目标检测

Jiekang Feng, Zhihe Fan, Yunqi Zhu, Xinjie Yao, Yueying Zhang, Yike Gao, Ranxin Li, Guanzuo Chen

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

AI总结 本文提出A2DINOv3框架,通过社会化协作协议让RGB与红外分支以异构专家模式选择性交互,结合零初始化策略,在四个多模态基准上实现了多模态目标检测的SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19490 2026-08-21 cs.RO cs.CV cs.LG 新提交 57%

Fine-Tuning VLAs with Self-Demonstrated Generative Control for Multi-Task Manipulation

通过自演示生成控制对视觉-语言动作(VLA)模型进行微调以实现多任务操作

Prachi Garg, Steve Xing, Prahit Yaugand, Saurabh Gupta, Derek Hoiem

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 指令微调 :pretraining(abstract);分类 cs.LG

AI总结 本文针对VLA模型部署到新机器人时因硬件不匹配导致性能下降的问题,提出自监督方法生成在线交互rollout数据微调VLA模型,使模型在目标机器人上同时具备先验任务能力、指令遵循能力与高效学习新技能的能力。

Comments Project Page: https://self-supervised-control.pages.dev/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16384 2026-08-18 cs.CV cs.LG 新提交 57%

Self-Routed Tensor Adapters for Parameter-Efficient Universal Visual Adaptation

用于参数高效通用视觉适配的自路由张量适配器

Suraj Yadav

机构 * Indraprastha Institute of Information Technology Delhi(因德拉普拉斯信息技术学院德里分校)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 提出自路由张量适配器(SRTA),无需外部门控网络即可实现样本特定适配,在多领域视觉分类基准上,以更少参数达到与MoE式PEFT基线相当或更优的平均准确率。

Comments Accepted at ECCV Workshop 2026 (Archival Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15037 2026-08-18 cs.SD cs.LG 新提交 57%

Prototype-Rectified Iterative Self-supervised Manifold Denoising under Severe Acoustic Shift

严重声学偏移下的原型修正迭代自监督流形去噪

Ashish Anand Shukla, Rini Smita Thakur, Aryan Das, Vinod K. Kurmi

机构 * Indian Institute of Science Education and Research(印度科学教育与研究学院) Vellore Institute of Technology(韦洛尔理工大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 针对严重声学噪声下音频-文本基础模型的失效问题,提出无训练无数据源的TTA框架PRISM,在UrbanSound8K数据集上取得显著性能提升,还解决了复音陷阱问题。

Comments Accepted as a full paper at ACM CIKM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15900 2026-08-18 cond-mat.mtrl-sci cs.LG 新提交 57%

Crystal-structure design by agentic AI in a language of motifs

基于基元语言的智能体AI晶体结构设计

Dinh-Khiet Le, Minh-Quyet Ha, Hong-Phuc Vu-Dinh, Takashi Miyake, Hiori Kino, Hieu-Chi Dam

机构 * Japan Advanced Institute of Science and Technology(日本先进科学技术学院) Institute of Science Tokyo(东京科学大学) The Institute of Statistical Mathematics(统计数理研究所) Tohoku University(东北大学)

专题命中 指令微调 :language model(abstract);分类 cs.LG

AI总结 该研究提出智能体AI框架MatEvolve,以基元语言设计晶体,在贫稀土永磁体设计中发现新结构原型的频率是生成模型的三倍以上,可揭示结构-性能关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14312 2026-08-17 cs.CL 新提交 57%

Envs-FORGE: Frontier-Optimized Reward-Grounded Environment Synthesis for Agent RL

Envs-FORGE:面向智能体强化学习的前沿优化、奖励驱动的环境合成方法

Xiaojun Wu, Cehao Yang, Honghao Liu, Xueyuan Lin, Zhichao Shi, Hao Zhou, Xuhui Jiang, Chengjin Xu, Jia Li, Jian Guo

机构 * IDEA Research(IDEA研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) DataArcTech Ltd.(DataArcTech有限公司)

专题命中 指令微调 :prompting(abstract);分类 cs.CL

AI总结 Envs-FORGE是面向智能体RL的奖励驱动环境合成方法,通过MILP选动作生成训练环境,在多模型及数据集上显著提升Pass@1等指标。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13250 2026-08-14 cs.CY cs.AI 新提交 57%

Follow the Norm: Accounting for Fine-Tuning and Prompt Effects on Model Rationales

遵循规范:考量微调与提示对模型理由的影响

Long Hoang Nguyen, Brice Valentin Kok-Shun, Guangyu Du, Ali Sunyaev

专题命中 指令微调 :prompting(abstract);分类 cs.AI

AI总结 该研究将AI视为代理主体,通过对LLaMA-3.2-11B等三个模型开展实验,发现违反规范的微调会改变模型的理由风格,而系统提示可覆盖该行为,支持对齐的分布式观点,为可争议监督提供了相关依据。

Comments Extended version with appendix; final version to appear in the Proceedings of AAAI/ACM AIES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12677 2026-08-14 cs.AI cs.CV 新提交 57%

The Role of Natural Language Understanding in Multimodal Video-Based Dengue Diagnosis

自然语言理解在基于多模态视频的登革热诊断中的作用

Danial Sharifrazi, Saadat Behzadi, Julakha Jahan Jui, Mojtaba Mohammadi, Nouman Javed, Roohallah Alizadehsani, Prasad N. Paradkar, Asim Bhatti

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 本研究提出基于YOLO和CLIP的视觉-语言框架,从视频中分类未受感染与DENV2感染的蚊子,帧级准确率达98.54%、灵敏度达99.91%,证实该框架可用于分析感染相关生物行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12328 2026-08-14 cs.CL 新提交 57%

LoRA-Diffusion: Parameter-Efficient Fine-Tuning via Low-Rank Trajectory Decomposition

LoRA-Diffusion:基于低秩轨迹分解的参数高效微调方法

Iman Khazrak, Narges Nejad, Mohammadhossein Homaei, Mostafa M. Rezaee, Robert C. Green

专题命中 指令微调 :language model(abstract);分类 cs.CL

AI总结 本文提出 LoRA-Diffusion,将低秩分解应用于扩散式语言模型的去噪轨迹而非权重,引入轨迹级适配器等技术,在 SST-2 等数据集上取得优异性能,为扩散式语言模型提供参数高效微调框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11588 2026-08-13 cs.AI 新提交 57%

CoAdapt-GUI: Joint Workflow Context and Policy Adaptation for Unseen GUI Applications

CoAdapt-GUI:面向未知GUI应用的工作流上下文与策略联合适配

Linqiang Guo, Li Gu, Zihuan Jiang, Zhixiang Chi, Siobhan Reid, Ziqiang Wang, Yuanhao Yu, Wei Liu, Yang Wang, Tse-Hsun, Chen

机构 * Li Gu(李谷(音译))

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 CoAdapt-GUI框架通过联合适配工作流上下文与策略,在有限交互预算无目标演示的未知GUI应用场景下,将AndroidWorld泛化性能提至45.0%、AndroidWorld Plus提至52.9%,优于仅策略TTA基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11350 2026-08-13 cs.CL cs.RO 新提交 57%

Self-Evolving Embodied Agents via Skill-Harness Evolution

基于技能-工具链进化的自演化具身智能体

Peidong Wang, Zhiming Ma, Ying Chang, Xufang Luo, Xiaocui Yang, Shi Feng, Yuqing Yang, Dongsheng Li

机构 * Microsoft Research(微软研究院) Northeastern University(东北大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.CL

AI总结 提出免训练的SHAPER框架,通过演化技能与工具链实现冻结模型驱动的自演化具身智能体,在VLABench等数据集上验证其适配优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10963 2026-08-12 cs.CL 新提交 57%

REAP: Relation-Aware Elicitation and Parsing for Closed-Book Knowledge Base Construction from LLMs

REAP:面向基于大语言模型的闭卷知识库构建的关系感知引出与解析

Thanh-Dan Bui, Thanh-Trung Do, Tuan-Phong Nguyen

机构 * VNU University of Engineering and Technology(VNU工程技术大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL

AI总结 该研究提出REAP系统,基于Mistral-Small-24B-Instruct-2501模型,结合结构化思维链推理等技术,在2026年AKBC共享任务闭卷知识库构建任务中取得宏F1值0.62,相关代码已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08896 2026-08-11 cs.AI 新提交 57%

From Manuals to Maintenance: Fine-Tuning MedGemma for Multi-Modal Imaging System Support in Low-Resource Settings

从手册到维护:在低资源场景中微调MedGemma以提供多模态成像系统支持

Bernes Lorier Atabonfack, Zion Kongbi Nfo, Ahmed Tahiru Issah, Tolulope Olusuyi, Clemence Ingabire, Mohammed Hardi Abdul Baaki, Mawuli Deku, Abdulrazaq Zubair, Alyasaa Anas, Raymond Confidence, Maruf Adewole, Udunna C. Anazodo

机构 * Carnegie Mellon University Africa(非洲卡内基梅隆大学) IngenziAI(因根齐人工智能公司) Federal University of Health Sciences Azare(阿扎雷联邦健康科学大学) University of Maiduguri Teaching Hospital(迈杜古里大学教学医院) Lawson Health Research Institute(劳森健康研究所) University of Pennsylvania(宾夕法尼亚大学) McGill University(麦吉尔大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

AI总结 针对中低收入国家医疗设备维护难题,研究人员构建INGENZI_DatasetV1数据集,用QLoRA微调MedGemma-4b-it模型,使维修问答指标大幅提升,为低资源场景AI辅助医疗维护奠定基础。

Comments Accepted at the AFRICAI 2026 Workshop, a satellite event at MICCAI 2026. To appear in Springer Lecture Notes in Computer Science (LNCS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08219 2026-08-11 cs.CV cs.AI 新提交 57%

VTO: Visual Tool Orchestration for Video Anomaly Detection

VTO:面向视频异常检测的可视化工具编排

Rui Wang, Yeteng Wu, Xianling Zhang, Mengshi Qi

机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学) School of Digital Media & Design Art(数字媒体与设计艺术学院)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

AI总结 针对视频异常检测中传统方法泛化差、多模态智能体工具编排难的问题,提出过程监督强化学习框架VTO,结合VAD-Tool工具集,在工具调度上较基线提升10.2%。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07282 2026-08-10 cs.CL cs.CV 新提交 57%

Gaze Behavior in Visual World Experiments Can be Modeled With Off-the-shelf Language-Vision Encoders

视觉世界实验中的注视行为可采用现成的语言-视觉编码器建模

Rahul Murali Shankar, Titus von der Malsburg, Sebastian Padó

机构 * University of Stuttgart(斯图加特大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL

AI总结 该研究提出结合CLIP双编码器与双模态归因方法的新方法,无需微调或生成式架构,即可复现经典视觉世界研究的人类注视行为预测结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06732 2026-08-10 cs.AI cs.CV cs.MM 新提交 57%

From Cheap Fakes to Pure Synthesis: Addressing the New Era of T2V Fake News Videos

从廉价伪造到纯合成:应对文本生成视频(T2V)假新闻视频的新时代

Yifeng Luo, Yupeng Li, Liang Lan, Tian Wang

机构 * Hong Kong Baptist University(香港浸会大学) Beijing Normal University(北京师范大学)

专题命中 指令微调 :prompting(abstract);分类 cs.AI

AI总结 该研究针对纯合成T2V假新闻视频带来的新威胁,构建了首个纯合成假新闻视频数据集,提出R-T2V框架,在10种主流基准上取得最优检测性能。

Comments Accepted at ACM Multimedia (ACM MM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05571 2026-08-07 cs.LG cs.IR 新提交 57%

Align-RAG: Alignment Is All You Need for TSFM In-Context Learning

Align-RAG:TSFM上下文学习的全部需求在于对齐

Mohammad Asadi, Soheil Hor, Bardiya Akhbari, Jack W. O'Sullivan, Tahoura Nedaee, Layne C. Price, Raviteja Anantha, Euan Ashley, Ehsan Adeli

机构 * Stanford University(斯坦福大学) Amazon(亚马逊公司)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 提出无需训练的Align-RAG方法,通过闭式对齐检索窗口,在冻结TSFM上提升检索增强预测性能,证明冻结TSFM可动态整合检索结果,闭式对齐可作为默认基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05475 2026-08-07 cs.LG 新提交 57%

KV-Skill: Forging Expertise in the Model's Native Language

KV-Skill:在模型的原生语言中锻造专业技能

Zhaowei Han, Xiang Zhang, Bing Han, Kai Liu, Danqi Hu, Jie Liu

机构 * University of Michigan(密歇根大学)

专题命中 指令微调 :language model(abstract);分类 cs.LG

AI总结 该研究提出KV-Skill,通过外部因子化算子存储任务知识,在多基准测试中提升了模型在LiveMath等任务上的准确率,且可独立加载多个技能无明显遗忘。

Comments 17 pages, 4 figures, 18 tables. Zhaowei Han and Xiang Zhang contributed equally to this work. Code: https://github.com/shawnzhg/KV-Skill

详情

展开后加载摘要…

URL PDF HTML 收藏