Position-Aware Parameter Efficient Fine-Tuning Approach for Reducing Positional Bias in LLMs
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted by ICLR2024
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code and data available at https://github.com/microsoft/simulated-trial-and-error
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to AAMAS 2024. 8 pages (excl. references), 5 figures/tables. (Appendix: 8 pages, 8 figures/tables). Code available at: https://github.com/probcomp/CLIPS.jl
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 28 pages, 8 figures, 10 tables
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);RLHF(abstract)
Comments ICLR 2024. Project Page: https://evalign-icl.github.io/
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
Comments 8
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 40 pages
专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code and models are available at https://github.com/ZrrSkywalker/LLaMA-Adapter
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 15 pages, 6 figures; 10 pages, 7 figures Supplementary Materials; under review at ECML 2023
专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments Accepted at "Adaptive Foundation Models: Evolving AI for Personalized and Efficient Learning" workshop at NeurIPS 2024
重新学习观察:面向视觉语言模型的自由格式裁剪重路由的损失间隙监督
专题命中 指令微调 :language model(title,abstract);分类 cs.CL
AI总结 提出GapSight框架,利用损失间隙监督让VLMs选择性重读图像局部区域,在多个基准测试中显著提升了LLaVA、InternVL2.5等VLMs的细节类任务性能。
FlatVPR: 用于基础模型特征流形几何校正的即插即用地线性残差适配器
机构 * Fundamental Engineering for Knowledge-Based Society, Graduate School of Engineering, University of Fukui(知识社会基础工程,工程研究生院,福井大学)
专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG
AI总结 提出FlatVPR范式,通过可学习残差适配器和Pullback Flatness Loss抑制特征流形曲率,实现稀疏锚点下的线性插值重建,在NCLT数据集上显著提升视觉位置识别精度。
Comments 16 pages, 4 figures, technical report; v2: Added supplementary materials for downstream tasks and included a supplementary roadmap in Section I
FourierSampler: 通过频率引导生成解锁扩散语言模型的非自回归潜力
专题命中 指令微调 :language model(title,abstract);分类 cs.CL
AI总结 FourierSampler通过频域滑动窗口机制,在扩散语言模型中实现非自回归生成,提升生成效果并超越自回归模型
Comments 15 pages, 6 figures, under review
将聚合出行统计数据提炼为语言模型策略以用于事件后人群模拟
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 该研究针对仅能获取聚合出行统计数据的场景,通过微调语言模型人群智能体并结合迭代比例拟合与低秩适配器,降低了事件后人群模拟的目的地份额误差。
Comments 4 pages, 3 figures. Accepted as a short paper at ACM SIGSPATIAL 2026
引导式蛋白质语言模型中的流形外坍塌
机构 * Duke University(杜克大学) ; Cornell University(康奈尔大学) ; University of Wisconsin--Madison(威斯康星大学麦迪逊分校)
专题命中 指令微调 :language model(title,abstract);分类 cs.LG
AI总结 该研究发现引导式蛋白质语言模型存在流形外坍塌问题,提出无需训练的马氏过滤方法,可低成本提升生成序列的属性得分与结构合理性,且可跨引导方法迁移。
Comments 12 pages
学习无需学习的内容:用于鲁棒视觉-语言模型的对抗性解耦提示调优
机构 * Southern University of Science and Technology(南方科技大学) ; City University of Hong Kong(香港城市大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 针对现有对抗性提示调优存在的鲁棒泛化过拟合问题,提出ADAPT框架,通过双提示机制解耦鲁棒与伪鲁棒特征,提升模型对未见类别对抗样本的鲁棒性。
LoREnc:低秩加密用于保护基础模型和LoRA适配器
机构 * Samsung Research(三星研究院) ; Samsung Electronics(三星电子) ; Amazon Web Services(亚马逊网络服务) ; University of Michigan(密歇根大学)
专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG
AI总结 LoREnc通过谱截断和补偿技术,在不重新训练的情况下保护基础模型和LoRA适配器,防止模型恢复攻击和知识产权泄露,实验表明其在1%计算开销下有效。
Comments Accepted to ICIP 2026
Journal ref 2026 IEEE International Conference on Image Processing (ICIP)
数据更少,收敛更快:面向多模态指令微调的目标驱动数据优化
机构 * Peking University(北京大学) ; University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; National University of Singapore(新加坡国立大学)
专题命中 指令微调 :instruction tuning(title,abstract);分类 cs.LG
AI总结 本文提出目标驱动数据优化框架GDO,通过优化训练样本实现更快收敛和更高精度,适用于多模态指令微调任务。
Comments Accepted to ECCV 2026
面向可迁移日前电价预测的、融合市场信息的基础门控低秩适配(Gated-LoRA)模型
专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG
AI总结 本文提出融合市场信息的Gated-LoRA框架,将Chronos-2模型迁移至日前电价预测,经中国四省现货市场验证,可显著降低预测误差,为数据稀缺电力市场提供迁移方案。
动态上下文适配器:将历史信息高效注入视觉-语言模型
机构 * University of Liverpool(利物浦大学) ; National Tsinghua University(国立清华大学) ; Imperial College London(伦敦帝国学院) ; National Taiwan University(国立台湾大学)
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 针对视觉-语言模型整合历史上下文时的计算与信息损失问题,提出动态上下文适配器(DCA),实现高效历史注入,降低注意力FLOPs超25%、内存13%,提升长时序任务性能。
每个模型一个适配器对:语言模型的通用激活接口
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 本研究提出通用激活总线框架,为兼容语言模型提供通用激活接口,每个模型配备轻量级适配器对,可实现激活工具跨模型共享与复用,为可复用工具建立稳定的激活契约。
ChronoState:用于冻结骨干语言模型中时间-状态动作选择的隐式流逝时间条件
机构 * Johns Hopkins University(约翰斯·霍普金斯大学)
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 该研究提出 ChronoState 基准,证实冻结骨干语言模型可在直接监督下将隐式流逝时间与符号状态组合,但其泛化性有限,且性能不及提示注入时间戳基线。
Comments Submitted to SPIE Defense and Commercial Sensing 2027