AI 安全:并非可选,也非推迟
AI Safety: Not Optional, Not Later
首次发表
浏览论文内容
中文总结 AI 辅助
针对多层面AI安全失效问题,提出结合模型级监督与系统级控制的安全设计保障架构,并辅以治理机制,以强化问责与证据互操作。
中文摘要 AI 辅助
事件表明,AI 安全失效往往跨越多个层面产生。我们提出一种安全设计保障架构,将模型级监督(如 Scientist AI)与系统级控制相结合,涵盖脚手架和工具链、独立验证、监控及证据基础设施,并由问责制与证据互操作性的治理机制提供支持。
英文摘要
Incidents show that AI safety failures often arise across multiple layers. We present a safety-by-design assurance architecture combining model-level supervision, such as Scientist AI, with system-level controls over scaffolds and harnesses, independent verification, monitoring, and evidence infrastructure, supported by governance for accountability and evidence interoperability.
发表机构
- CSIRO(联邦科学与工业研究组织)
- LawZero
- Université de Montréal(蒙特利尔大学)
- Mila(米拉)
机构由 AI 辅助整理,请以论文原文为准。