跳到正文
原文
arXiv:对齐与欺骗· arXiv:2609.08213· Rui Bao·· 24 天前

DRIFT:通过偏转生成轨迹去除扩散模型水印的黑盒攻击

DRIFT: Removing Diffusion Watermarks by Deflecting the Generative Trajectory

AI 导读

研究者提出 DRIFT,一种通过偏转生成轨迹去除扩散模型水印的黑盒攻击。该方法将部分前向扩散与随机反向重采样结合,前向加噪限制固定深度恢复流程可用的源信息,随机反向提供替代的噪声驱动路径;自适应 DRIFT 为每张图像搜索首个被验证器拒绝的阶梯并做保真度精修,只保留被同一验证器拒绝的更新。在覆盖三种范式的九种水印上,DRIFT 达到 98-100% 攻击成功率,并在所比较的攻击中取得最佳图像质量,且不需要密钥、验证器内部信息或逐图像梯度优化。

阅读原文arxiv.org