The Unlearning Mirage: A Dynamic Framework for Evaluating LLM Unlearning
消除幻觉:一种动态框架用于评估大语言模型的消除
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Stanford University(斯坦福大学) ; IBM Research(IBM研究院)
AI总结 本文提出了一种动态框架,用于评估大语言模型消除方法的鲁棒性,通过复杂结构查询揭示消除技术在多跳设置中的脆弱性,并提供可扩展的评估方法。
Comments Published at COLM 2025