Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents
针对终端代理的技能注入攻击的防御与使能因素
机构 * Patronus AI ; NVIDIA
AI总结 研究基于大语言模型的代理在重用技能时面临的安全威胁,提出守护者防御(动态和静态)将攻击成功率降低过半,并测试了攻击重述的鲁棒性。
Comments First version, small updates and clarifications likely in v2