跳到正文

隐私与数据泄露

训练数据提取、成员推断与模型记忆,以及 AI 产品和 Agent 造成的真实数据外泄。

101条精选相关主题提示注入Agent 安全真实事件

最新精选

第 101–101 条 · 共 101 条
9月30日周三
  1. Simon Willison · 收录 · 原文 30

    论文披露从专有 LLM API 窃取加密思维链的方法

    一篇论文发现 Anthropic、OpenAI 和 Google 返回给客户端的加密思维链块可在不同会话、用户和模型间重放,把前沿模型的推理轨迹喂给同族较弱模型并越狱后,即可还原出强模型的隐藏推理明文。

    推荐理由论文披露加密思维链块可在同族模型间重放并越狱还原,还衍生出借思维链实施提示注入的新变体。