SecureVibeBench: Benchmarking Secure Vibe Coding of AI Agents via Reconstructing Vulnerability-Introducing Scenarios
SecureVibeBench: 通过重建引入漏洞的场景来基准测试AI代理的安全振动编码
机构 * University of Science and Technology of China(中国科学技术大学)
AI总结 本文提出SecureVibeBench,一个包含105个C/C++安全编码任务的基准测试,旨在评估AI代理在真实场景中生成安全代码的能力,发现现有方法在评估人类与AI代理对比时的不足。
Comments ACL 2026 Main Conference. Our code and data are on https://github.com/iCSawyer/SecureVibeBench