arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~
arXiv 2609.10630cs.SEcs.AI

AI 安全:并非可选,也非推迟

AI Safety: Not Optional, Not Later

Qinghua Lu, Yoshua Bengio

首次发表
浏览论文内容

中文总结 AI 辅助

针对多层面AI安全失效问题,提出结合模型级监督与系统级控制的安全设计保障架构,并辅以治理机制,以强化问责与证据互操作。

中文摘要 AI 辅助

事件表明,AI 安全失效往往跨越多个层面产生。我们提出一种安全设计保障架构,将模型级监督(如 Scientist AI)与系统级控制相结合,涵盖脚手架和工具链、独立验证、监控及证据基础设施,并由问责制与证据互操作性的治理机制提供支持。

英文摘要

Incidents show that AI safety failures often arise across multiple layers. We present a safety-by-design assurance architecture combining model-level supervision, such as Scientist AI, with system-level controls over scaffolds and harnesses, independent verification, monitoring, and evidence infrastructure, supported by governance for accountability and evidence interoperability.

发表机构

  • CSIRO(联邦科学与工业研究组织)
  • LawZero
  • Université de Montréal(蒙特利尔大学)
  • Mila(米拉)

机构由 AI 辅助整理,请以论文原文为准。

补充信息

↑