跳到正文
原文
arXiv:后门、投毒与隐私· arXiv:2609.36117· Issam Seddik·· 3 天前

arXiv 论文分析神经网络为何容易被植入后门

Why Backdooring Neural Networks is so Easy?

AI 导读

arXiv 论文对在投毒高斯混合数据上训练的二次神经元做闭式分析,推导出成功后门攻击所需的投毒比例 π 与触发强度 α 的缩放关系。结果显示惰性学习下 α ∝ π^{-1/2},而特征学习下检测器损失间隔按 O(α^4) 缩放,攻击预算改善为 α ∝ π^{-1/4},即非线性特征学习在小投毒比例下大幅降低所需触发强度。作者指出,基于线性启发式的安全审计可能系统性低估特征学习机制下的后门脆弱性。

阅读原文arxiv.org