AI 的低调安全守门人正走向聚光灯下
AI’s quiet safety gatekeepers are stepping into the spotlight
AI 导读
Anthropic 与 OpenAI 承诺在内部嵌入第三方评估者,METR、Apollo Research 等小型非营利评估机构由此进入 AI 安全治理的中心。Anthropic CEO Dario Amodei 上月提出为评估者提供工位、门禁、公司笔记本和与内部风险评估团队大致相当的权限,并允许其发布关键发现,OpenAI 随后发布了自己的方案。资金与独立性仍是未解问题,METR 称过去六个月获得约 7100 万美元承诺,高于 2024 年全年 1360 万美元,Anthropic 则表示长期资金应来自联合或政府渠道。OpenAI 上周解雇三名员工,其中两人称原因是他们与第三方评估者的沟通方式,OpenAI 否认这一说法。加州州长 Newsom 签署两项涉及独立验证机构(IVO)的法案,联邦层面 Trahan 与 Obernolte 在 7 月提出 FRONTIER 法案。
推荐理由
报道梳理了 METR、Apollo 等第三方评估机构在资金、权限与独立性上的现实约束,以及联邦和州层面的监管进展。