Cognitive Cybersecurity for Artificial Intelligence: Guardrail Engineering with CCS-7
机构 * Independent Researcher(独立研究者)
专题命中 安全训练 :alignment(abstract);safety(abstract);分类 cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * Independent Researcher(独立研究者)
专题命中 安全训练 :alignment(abstract);safety(abstract);分类 cs.AI
机构 * Jungyup Lee, Jemin Kim, Sang Park, SeungJae Lee(作者)
专题命中 安全训练 :alignment(abstract);分类 cs.CL
专题命中 安全训练 :alignment(abstract);分类 cs.LG
机构 * Department of Automation, Tsinghua University(自动化系,清华大学)
专题命中 安全训练 :safety(abstract)
机构 * Beihang University(北航) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Taishan University(泰山大学) ; Nanyang Technological University(南洋理工大学) ; Henan University of Science and Technology(河南科技大学)
专题命中 安全训练 :safety(abstract)
专题命中 安全训练 :safety(abstract)
Journal ref Frontiers in Robotics and AI, Volume 9 - 2022