防御arXiv:2609.38983 · 9月30日论文提出 Approval Laundering 分类,实测 Claude Code 审批与执行绑定失败提出 Approval Token 绑定编程智能体的审批与执行编程 Agent·测试Claude Code (v2.1.197, opus[1m] / claude-sonnet-5-ccmax)、Codex CLI (@openai/codex v0.154.0)·应用层权限与审批Agent 危险操作权限与沙箱摘要系统揭示编程智能体审批洗白风险,提出七字段权能防御机制,证实其能消除身份时序偏离但难防副作用偏离。完整解读
评测与基准arXiv:2609.19587 · 9月17日红队测试 Auto Mode:用注入与多上下文攻击绕过编码 Agent 阻断监控器红队评估编码智能体的阻断监视器,并提出 Auto Mode++加固编程 Agent·测试Opus 5、Opus 4.8、Opus 4.7 等 8 个·应用层监控与审计欺骗与谋划监控器摘要系统评估生产阻断监视器在面对持续恶意智能体时的表现,提出加固防御并指明多上下文防御挑战。完整解读