Evaluating Adversarial Vulnerabilities in Modern Large Language Models
评估现代大语言模型中的对抗漏洞
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI
AI总结 本文评估了现代大语言模型在对抗攻击中的安全漏洞,通过比较Gemini 2.5 Flash和GPT-4的易受性,揭示了安全机制的差异及Transformer架构的潜在漏洞。