Attacking LLMs and AI Agents: Advertisement Embedding Attacks Against Large Language Models
机构 * Department of Computer Science Texas A\&M University–Corpus Christi Corpus Christi, TX, USA ; EECS Department University of Missouri Columbia, MO, USA ; Department of Computer Engineering University of California–Riverside Riverside, CA, USA
专题命中 越狱攻击 :safety(abstract);分类 cs.AI、cs.LG
Comments 6 pages, 2 figures