The Unseen Hand: Manipulating Model Fairness and SHAP with Targeted Identity Re-Association Attacks
无形之手:通过目标身份重新关联攻击操纵模型公平性和SHAP
机构 * National University of Sciences and Technology (NUST)(国立科技大学(NUST))
AI总结 提出目标身份重新关联(TIRA)攻击,通过概率性微扰操纵模型输出,在不留痕迹的情况下扭曲公平性指标和SHAP解释。
Comments Accepted at NeurIPS Workshops 2025