Overcoming the Retrieval Barrier: Indirect Prompt Injection in the Wild for LLM Systems
突破检索障碍:为LLM系统设计的野外间接提示注入
专题命中 提示注入 :prompt injection(title,abstract);分类 cs.AI
AI总结 本研究提出了一种高效且低成本的黑盒攻击算法,通过分解恶意内容为触发片段和攻击片段,实现了对LLM系统的间接提示注入攻击,揭示了检索过程中存在的关键安全漏洞。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
突破检索障碍:为LLM系统设计的野外间接提示注入
专题命中 提示注入 :prompt injection(title,abstract);分类 cs.AI
AI总结 本研究提出了一种高效且低成本的黑盒攻击算法,通过分解恶意内容为触发片段和攻击片段,实现了对LLM系统的间接提示注入攻击,揭示了检索过程中存在的关键安全漏洞。
超越助手的引导模型:通过对比解码控制系统提示强度
机构 * University of Cambridge(剑桥大学)
专题命中 提示注入 :alignment(abstract);分类 cs.CL
AI总结 通过对比解码控制系统提示强度,提升模型在复杂指令下的引导能力和准确性。