Adversarial Attack-Defense Co-Evolution for LLM Safety Alignment via Tree-Group Dual-Aware Search and Optimization
对抗攻击-防御共演进用于LLM安全对齐的树组双感知搜索与优化
机构 * Fudan University(复旦大学) ; Alibaba Group(阿里巴巴集团) ; Yale University(耶鲁大学) ; IBM Research AI(IBM人工智能研究) ; Indiana University(印第安纳大学)
专题命中 越狱攻击 :safety(title,abstract);alignment(title);jailbreak(abstract);分类 cs.AI
AI总结 ACE-Safety通过树组双感知搜索与优化,共同优化攻击与防御模型,提升LLM的安全对齐能力。