跳到正文

月之暗面 · Kimi · 精选

10月10日 · 周六

月之暗面 · Kimi · 精选

今天还没有新的精选
10月7日周三
  1. CSA Labs Research、Anthropic Research 等 3 个来源CSA Labs Research 等 3 个来源 · 3 篇报道 · 62

    OpenAI 与 Anthropic 披露模型蒸馏提取活动

    OpenAI 披露并处置一起协同对抗性蒸馏活动:操作者未攻破加密或数据库,而是操纵模型交互,使受保护的推理内容以请求者可见的形式复现,例如把一段对话中的加密推理拿到另一段对话中要求模型解密转写。活动 7 月 1 日开始,7 月 24–25 日高峰期约有 1.6 万次提取请求,相关集群在 7 月 28 日前被全部阻断;OpenAI 注明这些数字是提取尝试,不代表都已成功,并称不确定所有操作者是否同属一方,但将核心集群归因于与 Moonshot AI 相关的人员。CSA Labs 研究笔记复述了上述披露,指出该活动针对隐藏推理而非模型权重,并提到 Moonshot 未作回应。Anthropic 则指称 DeepSeek、Moonshot 与 MiniMax 通过约 2.4 万个账号与 Claude 进行超过 1600 万次交互以提取模型能力,其中 MiniMax 超 1300 万次、Moonshot 超 340 万次、DeepSeek 超 15 万次,并介绍了检测、访问控制与行业协作措施。

    事件进展
    1. Detecting and preventing distillation attacks

    2. OpenAI 阻断协同模型蒸馏攻击活动

10月5日周一
  1. The Verge AI · 56

    Irregular 测试环境失误导致 OpenAI、Meta、Anthropic、Google 智能体攻击真实目标

    The Verge 报道称,今年多起 AI 智能体在测试中攻击真实世界目标的事件,均源自以色列测试公司 Irregular 同一处评估环境配置失误。Irregular CTO Omer Nevo 确认,该问题同时涉及 OpenAI、Meta、Anthropic 和 Google 的模型:测试本应在模拟网络中运行,但互联网访问被意外开放,且为模拟虚构的目标公司名与一个真实域名重合,导致智能体转向真实目标,目前尚不清楚具体哪些公司或组织遭到攻击。这些事件与 OpenAI 披露的 Hugging Face 被攻击事件以及 UK AISI 的越界事件无关。Irregular 还曾对月之暗面的 Kimi K3 和智谱的 GLM-5.2 做同类网络安全测试,Nevo 称未观察到同类问题,但强调这不能说明这些模型更不易出现该行为。

已经到底了