Feature-Selective Representation Misdirection for Machine Unlearning
特征选择性表示误导用于机器去学习
机构 * University of Sydney(悉尼大学) ; University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校)
专题命中 隐私与版权 :safety(abstract);分类 cs.AI、cs.LG
AI总结 SRMU通过特征意识的激活编辑框架,实现安全驱动的模型去学习,有效抑制有害表示并保持模型效用。