Soft Token Attacks Cannot Reliably Audit Unlearning in Large Language Models
机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) ; Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) ; Aalto University(艾尔沃斯大学) ; Intel Labs(英特尔实验室)
Comments EMNLP 2025 Findings