防御arXiv 2609.16229·9月15日ARIA:用稀疏自编码器实现测试时机器遗忘提出 ARIA,在冻结权重上用 SAE 做推理时遗忘门控arXiv2609.16229发表9月15日层模型层场景模型与 API攻击者白盒防御推理时干预攻击提取与窃取组件推理链+2+2深度解读完整解读
防御arXiv 2609.15671·9月14日QPriv-VL:面向视觉语言模型的问题引导 token 裁剪隐私防御提出 QPriv-VL,用问题引导剪枝降低分布式视觉问答的隐私泄露arXiv2609.15671发表9月14日层训练与数据层场景模型与 API攻击提取与窃取组件视觉摘要QPriv-VL 在切层前按问题相关度与 DINOv2 敏感度剪视觉 token,作者称能在约四成 token 下兼顾准确率与四类攻击。QPriv-VL 把问题引导的视觉 token 剪枝做成分布式 VQA 的客户端隐私防御,而不是只做集中式推理加速。深度解读完整解读