OpenAI 与 Anthropic 披露模型蒸馏提取活动
OpenAI 披露并处置一起协同对抗性蒸馏活动:操作者未攻破加密或数据库,而是操纵模型交互,使受保护的推理内容以请求者可见的形式复现,例如把一段对话中的加密推理拿到另一段对话中要求模型解密转写。活动 7 月 1 日开始,7 月 24–25 日高峰期约有 1.6 万次提取请求,相关集群在 7 月 28 日前被全部阻断;OpenAI 注明这些数字是提取尝试,不代表都已成功,并称不确定所有操作者是否同属一方,但将核心集群归因于与 Moonshot AI 相关的人员。CSA Labs 研究笔记复述了上述披露,指出该活动针对隐藏推理而非模型权重,并提到 Moonshot 未作回应。Anthropic 则指称 DeepSeek、Moonshot 与 MiniMax 通过约 2.4 万个账号与 Claude 进行超过 1600 万次交互以提取模型能力,其中 MiniMax 超 1300 万次、Moonshot 超 340 万次、DeepSeek 超 15 万次,并介绍了检测、访问控制与行业协作措施。