研究揭示文本水印会诱发模型幻觉,并提出两种缓解干预
揭示检索生成中文本水印诱发事实幻觉的机制并提出 FPTI 与 FPAI 干预
论文研究生产级文本水印对大语言模型事实准确性的影响,分析了水印诱发幻觉的失效模式并评估了针对性缓解方案。
揭示检索生成中文本水印诱发事实幻觉的机制并提出 FPTI 与 FPAI 干预
论文研究生产级文本水印对大语言模型事实准确性的影响,分析了水印诱发幻觉的失效模式并评估了针对性缓解方案。
提出校准重合成认证,仅当已知生成器都不能保真重构时签发真实图像证书
提出 RECAST 框架,本地改写图表与语音以保护远程数值推理隐私
完整解读评测智能体记忆软撤回是否生效,并提出陈旧检索防护
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露