Imperceptible Jailbreaking against Large Language Models
机构 * Tsinghua University(清华大学) ; Sea AI Lab, Singapore(新加坡Sea AI实验室) ; Nanyang Technological University(南洋理工大学) ; Fudan University(复旦大学) ; Peng Cheng Laboratory(鹏城实验室)
专题命中 越狱攻击 :jailbreak(abstract);prompt injection(abstract);分类 cs.CL、cs.AI