防御arXiv 2609.01487·9月2日Defense-as-Skill:为技能增强型 Agent 演化运行时护栏技能提出 SkillSonar,把运行时防护做成可演化技能以拦截恶意技能arXiv2609.01487发表9月2日层应用层场景coding agent被测模型GLM-5、GPT-5.4、Claude Haiku 4.5 等 4 个防御指令与数据隔离攻击投毒与后门组件MCP 与技能深度解读完整解读
攻击arXiv 2607.10712·7月12日研究提出间接数据投毒攻击,可操纵 Claude、Codex 与 Gemini 的科研结论提出间接数据投毒攻击,操纵科研智能体得出虚假结论arXiv2607.10712发表7月12日层应用层场景science agent被测模型Claude Code with Claude Opus 4.7、Codex with GPT-5.5、Gemini CLI with Gemini 3.1 Pro防御指令与数据隔离攻击投毒与后门深度解读完整解读