攻击arXiv:2610.01365 · 10月1日ReGap:无需真实隐私数据即可通过微调重新提取模型隐私关联提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联模型与 API攻击者白盒灰盒·测试GPT-2 Small、GPT-2 Medium、GPT-2 Large 等 6 个·训练与数据层提取与窃取微调与开源权重摘要提出无真实私有监督的恢复攻击 ReGap,实验显示微调可通过自生成数据唤醒模型潜在隐私关联,突显后适应隐私风险。完整解读
攻击arXiv:2609.04382 · 9月4日研究揭示 split-LLM 训练中返回梯度泄露真实行,前向隐私门仍通过揭示拆分训练返回梯度以零支撑暴露诱饵行并泄露训练内容模型与 API攻击者白盒·测试Qwen3-0.6B、35B-A3B·训练与数据层提取与窃取摘要论文揭示拆分训练中反向梯度零支撑完全暴露诱饵行,联合视图突破门控,裁剪加噪可有效缓解。这是一项关于双节点大语言模型拆分训练系统的系统安全案例研究,揭示了评估工具遗漏反向信道所导致的静默隐私失效。完整解读
攻击arXiv:2608.09867 · 8月11日研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链模型与 API攻击者黑盒·测试Claude Opus 4.8、Claude Sonnet 4.6、Claude Haiku 4.5 等 15 个·提示层提取与窃取推理链操控推理链+1+1摘要论文揭示了客户端加密思维块跨模型互换漏洞,提出了低成本提取方法并给出防御方案。完整解读