Fully Unleashing the Multimodal Attacker: Meta-Adaptive Jailbreaking of Vision-Language Models
充分释放多模态攻击者的潜力:视觉语言模型的元自适应越狱攻击
专题命中 文档图表理解 :vision-language model(title,abstract);分类 cs.CV
AI总结 提出元自适应多模态越狱攻击(MAMJ),通过优化攻击策略提示与攻击者权重提升多模态越狱效果,在MM-SafetyBench上对多款前沿VLMs的攻击成功率显著优于基线,且可迁移至未见过的目标模型。
Comments Accepted by EMNLP 2026 Main Conference