跳到正文
原文
论文追踪· arXiv:2610.02841·本站收录 · 原文发表

多模态声明验证对 LLM 改写有多鲁棒?

How Robust Is Multimodal Claim Verification to LLM Rewriting?

AI 导读

研究测试了多模态声明验证任务对 LLM 改写的鲁棒性,采用自然改写和受控注入两种策略,评估了覆盖五个 VLM 家族、2B 至 38B 参数的 11 个开放权重模型。结果显示多数模型准确率无显著下降,验证任务比评审分数操纵稳定得多,但概率偏移持续存在:对冲类条件在几乎所有模型上引发显著偏移,增强类条件影响较弱,语法纠正等通用润色条件影响甚微。

阅读原文arxiv.org