Can Subgraph Explanations Be Weaponized to Steal Graph Neural Networks?
子图解释能否被武器化以窃取图神经网络?
机构 * University of Southern California(南加州大学) ; Florida State University(佛罗里达州立大学)
AI总结 本文提出首个针对图分类的黑盒模型提取攻击,利用模型解释输出引导蒙特卡洛边敏感性估计,并利用解释子图缩小边界搜索空间,实验表明该方法优于现有基线。
Comments 28 pages, 8 figures, 10 tables. Under review at NeurIPS 2026