防御arXiv 2607.04379·7月6日PA-LLM-RAG 框架的知识库投毒攻击与防御提出策略 RAG 的知识库投毒攻击与检测防御 CLD-KBarXiv2607.04379发表7月6日层应用层场景LLM 应用被测模型Llama 3.2防御检测与过滤攻击投毒与后门组件RAG+1+1深度解读完整解读
攻击arXiv 2606.12716·6月11日PaperGuard:针对多模态 AI 同行评审的攻击与防御基准提出 PaperGuard,用图文注入与梯度扰动抬高自动审稿分数并检测恶意指令arXiv2606.12716发表6月11日层应用层场景LLM 应用被测模型Claude-sonnet-4.5、GPT-4o、GPT-4.1 等 11 个攻击提示注入技术跨模态载荷组件视觉+2+2摘要PaperGuard 测到提示注入与白盒视觉抬分,并比较分块检索防御。PaperGuard同时评测并检测多模态 AI 审稿中的评分操纵。深度解读完整解读