Beyond LoRA vs. Full Fine-Tuning: Gradient-Guided Optimizer Routing for LLM Adaptation
超越LoRA与全微调:基于梯度的优化器路由用于大语言模型适应
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Tsinghua University(清华大学) ; Infinigence AI
专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 本文提出了一种混合LoRA和全微调(MoLF)框架,通过在优化器层面动态路由更新,实现两种训练模式之间的连续导航,从而提升大语言模型的适应性能。