跳到正文
10月10日 · 周六

全部论文

找到 9 篇
筛选6
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 208 篇还没打标签,不在筛选结果里。

另有 208 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 防御arXiv 2609.37568

    SECRET:用源条件化中继引导缓解音视频大语言模型的幻觉

    提出训练无关的 SECRET,对问题表征做源条件转向以缓解音视频模型幻觉

    发表
    被测模型
    VideoLLaMA2-AV-7B、Qwen2.5-Omni-7B、Qwen3-Omni-30B-A3B
    摘要SECRET 在问题状态上做源条件转向,三个 AVLLM 上减轻了跨模态接地幻觉。

    SECRET 是一种训练无关的问题状态转向方法,用来减轻 AVLLM 的 source-confused grounding hallucination。

    深度解读完整解读
  2. 防御arXiv 2607.24017

    多模态大模型注意力中的语义与结构偏差解耦:SPAR 免训练干预方法

    提出 SPAR 以分离注意力结构偏置并重分配视觉注意力,减轻多模态幻觉

    发表
    摘要SPAR 用显著性净化文本结构偏置并重分配注意力,在 LLaVA 上同时压低自发幻觉、抬升 gaslighting 后准确率。

    SPAR 是一种免训练的 MLLM 推理时干预,用来把注意力里的结构偏置和语义视觉信号分开。

    深度解读完整解读
  3. 防御arXiv 2605.08382

    SecureForge 通过提示词优化发现并减少 LLM 生成代码漏洞

    提出 SecureForge,在推理时优化系统提示以减少编码智能体的代码弱点

    发表
    被测模型
    Qwen 2.5 Coder 7B、Qwen 2.5 Coder 14B、Qwen3 30B-A3B 等 10 个
    摘要SecureForge 审计良性 CWE 失败并优化系统提示词。

    SecureForge是一条只用 API 和静态分析、在推理时加固编码模型的流水线。

    深度解读完整解读
已经到底了