可解释性arXiv 2610.00895
DiDAE:面向视觉基础模型的快速解耦反事实解释方法
提出 DiDAE,对冻结视觉基础模型做无梯度解耦反事实解释
- arXiv
- 2610.00895
- 发表
- 层
- 模型层
- 场景
- 模型与 API
- 测试
- ResNet-18、CLIP ViT-L/14、PLIP 等 8 个
- 组件视觉
摘要DiDAE 用无梯度字典编辑生成解耦反事实,并用于修正与排序。
DiDAE 用冻结视觉基础模型和一个解耦字典,生成按分量编辑的视觉反事实,再拿去修正依赖伪相关的分类器,或给字典原子按“是否真能翻转该分类器”排序。