TranScope:利用 CPU 性能计数器对 Transformer 做成员推断攻击
提出 TRANSCOPE,用 CPU 硬件计数器推断训练集成员
完整解读
另有 113 篇论文还没打上分类标签,暂不在筛选结果里。
提出 TRANSCOPE,用 CPU 硬件计数器推断训练集成员
提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据
提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联
提出 SigLeak,从执行轨迹比对中推断专有智能体技能
揭示拆分训练返回梯度以零支撑暴露诱饵行并泄露训练内容
这是一项关于双节点大语言模型拆分训练系统的系统安全案例研究,揭示了评估工具遗漏反向信道所导致的静默隐私失效。
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出用扰动蒸馏本地代理并离线过滤来提取黑盒模型凭据
提出主题锚点投毒,放大众包微调后的专有指令提取