评测与基准arXiv:2609.31342 · 9月25日研究揭示过期文档投毒:RAG 检索可让模型放弃原本正确的答案构建知识逆转基准,评测陈旧检索证据如何推翻模型原本正确的回答LLM 应用·测试GPT-4o、GPT-4.1、Claude-Opus-4.5 等 13 个·应用层RAG摘要论文评测了陈旧检索推翻正确知识的中毒现象,并分析了其内部机制与防御局限。这篇论文是对检索增强生成(RAG)中“陈旧文档中毒”现象的实证与机理评估研究。完整解读
攻击arXiv:2608.06862 · 8月7日SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件网页与电脑操作编程 Agent·测试Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B 等 5 个·应用层投毒与后门潜伏触发MCP 与技能+3+3摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。完整解读