Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification
大规模安全测试LLM智能体:从风险发现到基于证据的验证
机构 * AntGroup(蚂蚁集团) ; Zhejiang University(浙江大学) ; Fudan University(复旦大学) ; Alibaba Group(阿里巴巴集团) ; Hunan Institute of Advanced Technology(湖南先进技术研究院) ; Deakin University(迪肯大学)
专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI
AI总结 提出Vera框架,通过文献驱动的风险发现、组合生成可执行安全用例和自适应执行与证据验证三阶段流水线,实现端到端自动化安全测试,在四个生产级智能体框架上发现严重漏洞,平均攻击成功率93.9%。