Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language Models
专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.LG
Comments Accepted to ICLR'25
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.LG
Comments Accepted to ICLR'25
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.AI、cs.LG
专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI
Comments Accepted to the 8th Workshop on Online Abuse and Harms (WOAH), ACL 2024
Journal ref in: 8th Workshop on Online Abuse and Harms (WOAH), ACL (2024)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
专题命中 指令微调 :large language model(title);language model(title);foundation model(abstract);分类 cs.AI、cs.LG
Comments GitHub link MLSys/Financial-Time-Series" target="_blank" rel="noopener">https://github.com/UVA-MLSys/Financial-Time-Series
专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG
Comments 3 figures
专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI
Comments This paper has been accepted by NLPCC-2024
专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.LG
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI
专题命中 指令微调 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
Comments 26 pages, 8 figures. Project website: https://allenai.github.io/re-align/
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG
Comments 21 pages, 4 figures, 8 tables
专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG
Comments Update the title in the PDF file
专题命中 指令微调 :large language model(title);language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG
Comments Accepted to Uncertainty in Artificial Intelligence (UAI) 2023 Conference; 13 pages, 4 figures (Main Paper) + 5 pages (Supplementary Material)
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG
Comments 41 pages (without references), 13 figures; public report of Cyber-Defence Campus
专题命中 指令微调 :language model(title,abstract);prompting(title);分类 cs.CL、cs.LG
Comments Accepted to EMNLP 2022
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI
Comments Accepted as a long paper to EMNLP 2021 Main Conference
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG
机构 * Computer Science Department(计算机科学系) ; Applied Economics Department(应用经济学系)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI
Comments 6 pages, 3 figures, 4 tables, 1 algorithm, accepted in the Robustness and Security of Large Language Models (ROSE-LLM) special session at ICMLA 2025
专题命中 指令微调 :large language model(title);language model(title);LLM(abstract,comments);分类 cs.LG
Comments Accepted by ICASSP 2024 (Federated LLM)
改进基于影响力的指令调优数据选择以实现多样化能力的均衡学习
专题命中 指令微调 :instruction tuning(title);LLM(abstract_cn);large language model(abstract);language model(abstract)
AI总结 该研究针对基于影响力的指令调优数据选择的任务偏向问题,提出BIDS算法,经实验验证其在小比例数据下可实现更均衡性能且优于现有方法。
Comments Accepted to EMNLP 2025 (Findings)
RedditPersona: 一个用于从Reddit进行社区条件化LLM适配的模块化框架
机构 * Future Computing Group University of Oulu(未来计算组奥卢大学) ; Centre for Applied Computing University of Oulu(应用计算中心奥卢大学)
专题命中 指令微调 :LLM(title,title_cn);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出RedditPersona模块化框架,通过五种分组策略和QLoRA训练参数高效适配器,在112个Reddit子版块上评估社区条件化语言模型,发现适配器的行为可识别性与策略内在一致性相关,且所有策略在可识别性和分布相似性之间存在一致权衡。
Comments Accepted manuscript (CC BY 4.0). To appear in ACM CIKM 2026, Rome, Italy, Nov 7-11, 2026. DOI: https://doi.org/10.1145/3799682.3840182
HermesHFL:用于动态大语言模型微调的激励兼容分层联邦遗忘
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 针对大语言模型微调中分层联邦遗忘面临的挑战,提出HermesHFL框架,通过参数高效微调支持选择性遗忘等。制定统一优化问题,开发Neogen框架解决,实验表明该框架在模型效用等多方面优于现有基线。
Comments 15pages,8 figures
单独无害,联合有害:在自进化大语言模型智能体中利用经验组合
专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract)
AI总结 本研究提出EvoBreak攻击,利用自进化LLM智能体的良性经验组合,结合BreakGym生成训练目标,在保持高无害性的同时优于现有攻击,揭示了新的安全风险。
设备优先反馈:面向移动端原生大语言模型驱动的神经网络架构搜索
机构 * University of Würzburg(维尔茨堡大学) ; CAIDAS ; IFI
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 该研究提出自动化移动端部署闭环流水线,针对CIFAR-10、CIFAR-100基准在三星平板验证,发现GPU微调无法保证移动端性能单调提升,需多数据集设备端测量。
Comments 11 pages, 4 figures, 4 tables. Code: https://github.com/ABrain-One/nn-gpt
基于大语言模型的自动出价的策略感知参数高效适配
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究广告自动出价问题,提出SAGE框架,通过位置增强、文本对齐和约束门控LoRA三个组件,实现参数高效多模态对齐,在大规模基准实验中性能卓越,调整参数少,消融研究验证各组件贡献。
MM-ARC:具有稳健性审核策略池的资本多模态自适应路由
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)
AI总结 研究金融交易系统如何转化多模态市场历史,提出MM-ARC方法,通过多视图在不同专家间分配资本,经稳健性审核筛选候选方案,实验显示该方法在夏普比率和最大回撤等指标上优于基线,有相对基准的支持。
语言模型中激活引导的内生抵抗
机构 * University of Washington(华盛顿大学)
专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究发现大型语言模型在任务不匹配的激活引导下能内生抵抗,通过显式重启恢复正确生成,并识别出相关稀疏自编码器潜在变量,可增强或削弱该抵抗。