Evaluating Large Language Models for Symbolic Security Protocol Analysis
评估用于符号安全协议分析的大语言模型
专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI
AI总结 研究评估大语言模型对符号安全协议的分析能力,通过在130个协议上测试GPT和DeepSeek,发现聊天与推理模型各有优劣,在认证目标上表现差,保密性较好,结果不稳定,整体LLMs无法与形式化验证相比,仅可作预筛选。
Comments 36 pages, 5 figures