SECA: Semantically Equivalent and Coherent Attacks for Eliciting LLM Hallucinations
SECA:用于诱发LLM幻觉的语义等价且连贯的攻击
专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 SECA通过现实修改提示诱发LLM幻觉,提高攻击成功率并减少语义错误。
Comments Accepted at NeurIPS 2025. Code is available at https://github.com/Buyun-Liang/SECA