防御arXiv:2607.13716 · 7月15日CAVA:面向智能体 AI 运行时治理的规范动作验证与证明提出 CAVA,把异构智能体运行时事件规范成可哈希动作并绑定审批与回执AI Agent·应用层权限与审批Agent 危险操作权限与沙箱摘要CAVA 用规范动作指纹承接异构运行时治理。CAVA 是给异构智能体运行时用的动作语义层,用来回答“被批准和被审计的到底是哪一个动作”。完整解读
攻击arXiv:2609.15989 · 9月15日研究者提出 plan injection 攻击,可绕过思维链监控提出计划注入攻击,植入良性表述的有害计划以逃避思维链监控模型与 API攻击者黑盒·测试Qwen2.5-Coder-7B-Instruct、Qwen3-8B、DeepSeek-R1-0528 等 6 个·提示层检测规避推理链操控监控器+3+3摘要论文指出模型会将外部上下文中的伪装计划改写为自身推理,使思维链监视器失效甚至反向合理化恶意行为。完整解读