Visual-Guided Key-Token Regularization for Multimodal Large Language Model Unlearning
多模态大语言模型去敏中的视觉引导关键标记正则化
机构 * The University of Melbourne(墨尔本大学) ; Google Research(谷歌研究) ; Hong Kong Baptist University(香港 Baptist 大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
AI总结 本文提出视觉引导的关键标记正则化方法,用于多模态大语言模型的去敏,通过信息熵定义关键标记并利用梯度重新加权提升去敏效果,实验表明能有效减少遗忘并保持响应一致性。