Towards Benchmarking Privacy Vulnerabilities in Selective Forgetting with Large Language Models
面向大语言模型中选择性遗忘隐私漏洞的基准测试
专题命中 隐私与版权 :alignment(abstract);分类 cs.LG
AI总结 本文提出首个评估选择性遗忘隐私漏洞的基准,系统研究了反向学习技术的隐私漏洞,并为定制应用提供标准化工具。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
面向大语言模型中选择性遗忘隐私漏洞的基准测试
专题命中 隐私与版权 :alignment(abstract);分类 cs.LG
AI总结 本文提出首个评估选择性遗忘隐私漏洞的基准,系统研究了反向学习技术的隐私漏洞,并为定制应用提供标准化工具。