TeleAI-Safety: A comprehensive LLM jailbreaking benchmark towards attacks, defenses, and evaluations
TeleAI-Safety: 一种全面的LLM jailbreaking基准测试,面向攻击、防御和评估
专题命中 安全评测 :safety(title,abstract);jailbreak(abstract)
AI总结 TeleAI-Safety提出了一种全面的LLM安全评估基准,整合多种攻击、防御和评估方法,用于系统性评估LLM的安全性及优化防御策略。