跳到正文
原文
arXiv:可解释性· arXiv:2609.30993· Drandreb Earl O. Juanico·· 7 天前

FLIP:面向视觉语言模型的末层推理时探针

FLIP: Final Layer Inference-Time Probing for Vision-Language Models

AI 导读

FLIP 是一种末层推理时探针,用于检验开放权重视觉语言模型中面向 logit 的干预位点是否支持结构化、任务相关的计算。它对最终归一化隐藏状态做逐元素下限截断,不改变参数、提示词与解码,在检测/计数探针上随干预强度呈现无变化、有界内部区间(IoU 0.50 下检测召回率 R50 提升、容错计数误差下降)与过度抑制三种区域。该方法被定位为干预式机制可解释性的验证步骤,而非引导方法。

阅读原文arxiv.org