The Vulnerability of LLM Rankers to Prompt Injection Attacks
大语言模型排序器对提示注入攻击的脆弱性
专题命中 提示注入 :prompt injection(title,abstract);jailbreak(abstract)
AI总结 本文研究了大语言模型排序器对提示注入攻击的脆弱性,通过实验证明不同架构和设置下的攻击效果,并揭示了编码器-解码器架构的抗性。
Comments 18 pages, 7 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
大语言模型排序器对提示注入攻击的脆弱性
专题命中 提示注入 :prompt injection(title,abstract);jailbreak(abstract)
AI总结 本文研究了大语言模型排序器对提示注入攻击的脆弱性,通过实验证明不同架构和设置下的攻击效果,并揭示了编码器-解码器架构的抗性。
Comments 18 pages, 7 figures
面向代理计算的安全基础
专题命中 提示注入 :safety(abstract);prompt injection(abstract);AI safety(abstract)
AI总结 本文从系统安全角度出发,分析代理型AI的安全挑战,提出端到端安全属性研究,涵盖11个现实攻击案例并定义新的研究问题。