防御arXiv 2609.07063
VERITAS:抗投毒的本地差分隐私图学习协议
提出 VERITAS,用双边背书剪除本地隐私图学习中的投毒节点
- arXiv
- 2609.07063
- 发表
- 场景
- 模型与 API
- 测试
- GCN、GraphSAGE、GAT
摘要VERITAS 用分级信任的双边背书剪除 LDP 图学习中的投毒节点,并恢复分类准确率。
VERITAS 是面向本地差分隐私图学习的投毒防御协议,按 trust-but-verify 在保持 ϵ-LDP 的同时剪除伪造节点。
提出 VERITAS,用双边背书剪除本地隐私图学习中的投毒节点
VERITAS 是面向本地差分隐私图学习的投毒防御协议,按 trust-but-verify 在保持 ϵ-LDP 的同时剪除伪造节点。
提出联邦学习细粒度分布式后门框架 FDBA,用动态触发与对比嵌入降低投毒比例
提出主题锚点投毒,放大众包微调后的专有指令提取
摘要论文提出基于主题锚点的数据中毒攻击,证明低比例的中毒样本可在黑盒条件下隐蔽放大微调指令泄漏。