跳到正文
原文
arXiv:对齐与欺骗· arXiv:2609.23596· Ben Shapira·· 11 天前

StyleAT:用对抗训练防御人脸识别的语义攻击

StyleAT: Defending Face Recognition Against Semantic Attacks

AI 导读

针对人脸识别模型易受对抗性语义编辑(如轻微老化或姿态变化)攻击的问题,研究者提出语义攻击 BoundStyle,在 StyleGAN 潜空间中最大化误分类率,攻击成功率高的同时比现有 SOTA 攻击快约 9.5 倍。基于 BoundStyle 构建的对抗训练方案 StyleAT 采用低预算攻击变体,却能防御更强和未见过的语义攻击。在两个训练中未见的数据集和七个模型上,StyleAT 提升了针对 SOTA 攻击的鲁棒准确率,并在多种设置下优于常见防御方法。

阅读原文arxiv.org