Tracing Target Answers in Poisoned Retrieval Corpora via Token Influence Attribution
通过令牌影响归因追踪中毒检索语料库中的目标答案
机构 * National Yang Ming Chiao Tung University(阳明交通大学) ; IBM Research(IBM研究院) ; Hon Hai Research Institute(宏海研究院)
AI总结 提出TRACE框架,通过令牌影响归因识别检索增强生成系统中的语料投毒攻击,无需额外分类器或LLM验证,在三个QA基准和六个LLM上验证了有效性。
Comments This paper has been accepted to EMNLP 2026 Industry Track