防御arXiv 2610.05826
研究者提出临时可见性协议,限制持续摄入 RAG 向量库的投毒暴露
提出临时可见性协议,限制持续摄入 RAG 向量库的投毒暴露
- arXiv
- 2610.05826
- 发表
- 层
- 应用层
- 场景
- LLM 应用
摘要用截止期限制未核验可见时长。
这篇工作给持续摄入的 RAG 向量库一个失败关闭的临时可见性协议,把协议能限制的未核验暴露和依赖检测器的中毒暴露分开。
提出临时可见性协议,限制持续摄入 RAG 向量库的投毒暴露
这篇工作给持续摄入的 RAG 向量库一个失败关闭的临时可见性协议,把协议能限制的未核验暴露和依赖检测器的中毒暴露分开。
提出 ToolFence,以能力蓝图和确定性授权拦截 Agent 未授权工具调用
提出 Provenance-Aware Transformers,隔离不可信来源防御间接提示注入
用任务绑定令牌和策略预言机拦住多智能体流水线的未授权执行
作者在一条会改写沙箱邮件库的四智能体流水线上,检查低权限失陷会不会变成未授权的真实动作。
提出神经符号纵深架构,阻断 AI-SOC 的日志投毒与间接提示注入
构建 COUNTER-GEO-BENCH,评测生成式搜索中的 GEO 虚假信息防御
摘要论文构建了针对 GEO 虚假信息的首个防御基准,揭示通用护栏的失效与反作用,并提出了有效的轻量对比检测基线。
提出类型化溯源与断言护栏,约束持久 Agent 释放自传断言
提出策略 RAG 的知识库投毒攻击与检测防御 CLD-KB