PII-VisBench: Evaluating Personally Identifiable Information Safety in Vision Language Models Along a Continuum of Visibility
PII-VisBench: 在可见性连续体上评估视觉语言模型中个人可识别信息安全性
机构 * University of California, Riverside(加州大学河滨分校)
专题命中 隐私与版权 :safety(title,abstract);alignment(abstract);jailbreak(abstract);分类 cs.CL、cs.AI
AI总结 PII-VisBench 评估视觉语言模型在可见性连续体上对个人可识别信息安全性的保护,通过4000个探测器分析不同可见性水平下的隐私泄露情况。