Graph of Attacks with Pruning: Optimizing Stealthy Jailbreak Prompt Generation for Enhanced LLM Content Moderation
机构 * Amazon Bedrock Science(亚马逊Bedrock科学) ; Drexel University(德雷塞尔大学) ; University of Virginia(弗吉尼亚大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 14 pages, 5 figures; published in EMNLP 2025 ; Code at: https://github.com/dsbuddy/GAP-LLM-Safety