攻击arXiv:2608.06862 · 8月7日SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件网页与电脑操作编程 Agent·测试Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B 等 5 个·应用层投毒与后门潜伏触发MCP 与技能+3+3摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。完整解读
攻击arXiv:2609.01023 · 9月1日Akrasia:针对推理型代码 LLM 的隐蔽后门攻击提出 AKRASIA 推断期后门,用代码级触发器与伪装推理操纵代码模型编程 Agent·测试Claude-Sonnet-5、GPT-5.5、Gemini-3.5-flash 等 7 个·提示层提示注入潜伏触发推理链+1+1摘要论文针对推理代码大模型提出了隐蔽推断期后门攻击 AKRASIA,揭示了模型思维链可被利用进行欺骗性伪装的安全隐患。完整解读