Death by a Thousand Prompts: Open Model Vulnerability Analysis
机构 * Cisco AI Threat Research & Security(思科AI威胁研究与安全)
专题命中 安全训练 :alignment(abstract);safety(abstract);jailbreak(abstract);prompt injection(abstract)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Cisco AI Threat Research & Security(思科AI威胁研究与安全)
专题命中 安全训练 :alignment(abstract);safety(abstract);jailbreak(abstract);prompt injection(abstract)
机构 * Tokyo Women’s Medical University(东京女子医科大学)
专题命中 安全训练 :alignment(abstract);分类 cs.AI、cs.CY
Comments 14 pages, 2 tables, 1 figure
专题命中 安全训练 :safety(abstract);分类 cs.AI
Comments Under review
专题命中 安全训练 :safety(abstract);分类 cs.AI