Attention Hijacking: Response Manipulation Across Queries in Vision-Language Models
注意力劫持:跨查询的视觉-语言模型响应操控
机构 * Hong Kong University of Science and Technology(香港理工大学) ; Shanghai Jiao Tong University(上海交通大学) ; Beihang University(北京航空航天大学)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);分类 cs.CV、cs.AI
AI总结 本文研究了视觉-语言模型中跨查询响应操控问题,提出了一种新的对抗攻击方法Attention Hijacking,通过引导内部注意力分布保持图像主导模式,提高攻击在不同查询下的有效性。