被解雇的 OpenAI 安全研究员否认不当行为指控,警告寒蝉效应
Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect
AI 导读
Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名上周被 OpenAI 解雇的安全研究员发布公开信,否认公司关于他们在既定流程之外不当处理敏感信息的指控,并警告此次解雇会在公司内部造成寒蝉效应。OpenAI 称调查发现他们存在“不当处理研究信息”的违规模式,但未回应具体违反了哪些政策。三人还否认向 The Information 泄露有关 OpenAI 最新模型可监控性下降、思维链推理更难被监控的信息,也否认在职责范围之外接触外部机构。公开信称,Korbak 在与外部安全评估方沟通时认为自己在遵循公司政策,Balesni 处理 AI 可监控性问题时得到 OpenAI 董事会成员和高管的支持。Wang 在 X 上称,她因访问一名高管的邮箱被解雇,但该权限是公司为招聘委托给她的,她误开敏感邮件后几分钟内即告知该高管。
推荐理由
三名被解雇的安全研究员公开否认不当处理信息,并披露与外部评估机构协作的细节,呈现了前沿实验室安全团队与外部问责之间的张力。
阅读原文