攻击arXiv:2610.09981 · 10月7日研究:LLM 路由决策日志可推断用户医疗、自伤等敏感话题提出利用路由元数据推断敏感话题的侧信道攻击LLM 应用·测试RouteLLM (BERT router)、notdiamond-0001、Vela (vLLM Semantic Router) 等 6 个·基础设施层提取与窃取侧信道摘要论文揭示并测量了 LLM 路由决策在无文本日志中的敏感话题泄露,验证了按类别公平性防御的有效性与边界。完整解读
攻击arXiv:2610.06848 · 10月5日TranScope:利用 CPU 性能计数器对 Transformer 做成员推断攻击提出 TRANSCOPE,用 CPU 硬件计数器推断训练集成员模型与 API攻击者黑盒·测试BERT (4.4M-340M)、ViT (22M-307M)、Pythia (70M-2.8B) 等 5 个·基础设施层提取与窃取侧信道摘要TRANSCOPE 揭示了分词器在嵌入表引发的硬件访问局部性差异,证实微架构计数器可突破恒定时间与置信度遮蔽防御。完整解读
攻击arXiv:2610.01365 · 10月1日ReGap:无需真实隐私数据即可通过微调重新提取模型隐私关联提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联模型与 API攻击者白盒灰盒·测试GPT-2 Small、GPT-2 Medium、GPT-2 Large 等 6 个·训练与数据层提取与窃取微调与开源权重摘要提出无真实私有监督的恢复攻击 ReGap,实验显示微调可通过自生成数据唤醒模型潜在隐私关联,突显后适应隐私风险。完整解读
攻击arXiv:2609.04382 · 9月4日研究揭示 split-LLM 训练中返回梯度泄露真实行,前向隐私门仍通过揭示拆分训练返回梯度以零支撑暴露诱饵行并泄露训练内容模型与 API攻击者白盒·测试Qwen3-0.6B、35B-A3B·训练与数据层提取与窃取摘要论文揭示拆分训练中反向梯度零支撑完全暴露诱饵行,联合视图突破门控,裁剪加噪可有效缓解。这是一项关于双节点大语言模型拆分训练系统的系统安全案例研究,揭示了评估工具遗漏反向信道所导致的静默隐私失效。完整解读