可解释性arXiv 2609.30993
FLIP:面向视觉语言模型的末层推理时探针
提出 FLIP 末层推理时探针,检验视觉语言模型干预效应的来源
- arXiv
- 2609.30993
- 发表
- 层
- 模型层
- 场景
- 模型与 API
- 测试
- Kimi-VL-A3B、Qwen3-VL-4B-Instruct、Qwen3-VL-8B
- 组件视觉
摘要末层 flooring 扫描在四准则下通过,原始层和左右对照没有同一正向区间。
FLIP 是开源 VLM 上的推理时末层探针,用来检验干预效应是否结构化、与任务相连,而不是用来转向模型。。