Jailbreaks on Vision Language Model via Multimodal Reasoning
通过多模态推理实现对视觉语言模型的逃逸攻击
机构 * Novi High School, MI, USA(诺维高中) ; Michigan State University, MI, USA(密歇根州立大学)
专题命中 视觉问答 :vision language model(title);vision-language model(abstract);visual question answering(abstract);分类 cs.CV、cs.AI
AI总结 本文提出了一种基于多模态推理的逃逸攻击框架,通过训练后链式推理和自适应噪声机制提高对视觉语言模型的安全过滤器的绕过能力。