Are Frontier LLMs Ready for Cybersecurity? Evidence for Vertical Foundation Models from Dual-Mode Vulnerability Benchmarks
前沿大语言模型是否已为网络安全做好准备?来自双模式漏洞基准测试的垂直基础模型证据
机构 * super-intel.ai(超级智能人工智能公司)
专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI
AI总结 通过白盒函数级漏洞检测和黑盒Web应用安全测试双模式基准测试,评估前沿大语言模型在网络安全任务中的表现,发现其存在高误报率、低覆盖率等问题,而领域专用模型通过结构化方法显著提升性能。