Analysing Safety Risks in LLMs Fine-Tuned with Pseudo-Malicious Cyber Security Data
机构 * University of Kent(肯特大学)
专题命中 红队测试 :safety(title,abstract);alignment(abstract);red teaming(abstract);prompt injection(abstract)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * University of Kent(肯特大学)
专题命中 红队测试 :safety(title,abstract);alignment(abstract);red teaming(abstract);prompt injection(abstract)
专题命中 红队测试 :prompt injection(abstract);分类 cs.AI
Comments 17 pages, 6 figures, 2 Tables