评测与基准arXiv:2608.12851 · 8月13日研究者提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化风险构建 SKILLMISEVO-BENCH,评测自进化编程智能体的技能误演化风险编程 Agent·测试Claude Code、Codex、Hermes 等 6 个·应用层投毒与后门潜伏触发记忆完整解读
攻击arXiv:2609.30383 · 9月25日研究者提出技能级联攻击提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测编程 Agent·测试GPT-5.4、GPT-5.4 Mini、Claude Opus 4.6 等 10 个·应用层投毒与后门编码与混淆MCP 与技能+2+2摘要论文探讨了多技能智能体系统面临的技能级联攻击风险,提出自动化红队框架与基准集,指出跨技能交互存在安全防护盲区。完整解读