跳到正文
原文
论文追踪· arXiv:2609.10630· Qinghua Lu, Yoshua Bengio·本站收录 · 原文发表

论文提出 AI 安全设计保障架构:结合 Scientist AI 模型级监督与系统级控制

AI Safety: Not Optional, Not Later

AI 导读

一篇获邀发表于 IEEE Software 2027 年 1 月刊的论文提出"安全设计"(safety-by-design)保障架构,将 Scientist AI 等模型级监督与系统级控制相结合。该架构覆盖 scaffold 与 harness 控制、独立验证、监控和证据基础设施,并由治理机制支撑问责与证据互操作。作者指出,事故表明 AI 安全失效往往出现在多个层面。

阅读原文arxiv.org