HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
机构 * University of Arizona(亚利桑那大学)
专题命中 越狱攻击 :jailbreak(title,abstract);分类 cs.AI
Comments This paper has been accepted for presentation at the Conference on Applied Machine Learning in Information Security (CAMLIS 2025)