跳到正文
原文
MLCommons(安全评测相关)· MLCommons·· 2026-08-27

MLCommons 联合 Google DeepMind 完成首个闭源模型双重盲测概念验证

The key to trustworthy AI evaluation is secrecy by design

AI 导读

MLCommons 与 Google DeepMind、OpenMined、AVERI 合作完成了全球首个针对闭源模型的双重盲评概念验证,通过密码学保证在不暴露双方资产的前提下运行评测。该方案由 AVERI 借助 OpenMined 的安全计算执行,在一个容器化的 Google DeepMind 模型中运行来自 AILuminate 安全基准预留子集的提示词,确保被测模型此前从未接触过这批题目。此举使开发者看不到测试数据、仪器方(MLCommons)与审计方(AVERI)也拿不到模型的权重,从而避免污染基准并维持其完整性。

阅读原文mlcommons.org