跳到正文
10月8日 · 周四

隐私与数据泄露 · 论文

找到 3 篇
筛选2
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 110 篇还没打标签,不在筛选结果里。

另有 110 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 可解释性arXiv:2610.04860 ·

    研究揭示文本水印会诱发模型幻觉,并提出两种缓解干预

    揭示检索生成中文本水印诱发事实幻觉的机制并提出 FPTI 与 FPAI 干预

    LLM 应用测试LLaMA 3.1 8B Instruct、Mistral-7B-Instruct-v0.3、Qwen2.5-14B-Instruct模型层
    摘要论文揭示了生产环境文本水印导致模型事实退化的失效模式,分析了解码机制并提出针对性干预。

    论文研究生产级文本水印对大语言模型事实准确性的影响,分析了水印诱发幻觉的失效模式并评估了针对性缓解方案。

    完整解读
已经到底了