跳到正文
原文
Failure-First·· 18 天前

《The safety failures we are not instrumenting》:现代 AI 系统中隐藏的安全关键挑战

[Daily Paper] The safety failures we are not instrumenting: a perspective on hidden safety-critical challenges in modern AI systems

AI 导读

一篇立场文章指出当前 AI 安全讨论聚焦于可见的输出异常,却忽视了由整个部署栈交互产生的隐性系统性失效。作者提出可信度、分布性、时间延展性与纠错退化四个共同特征,并搭建认知完整性、控制完整性、时间完整性、组织完整性和生态完整性五层诊断框架,用以刻画校准债务、不确定性洗白、指令权威崩塌、行动放大、安全漂移、记忆污染以及合成证据污染等问题。

阅读原文failurefirst.org