防御arXiv 2607.19913·7月22日Janus:面向长时程智能体安全的前瞻性潜在风险预测框架提出 Janus 前瞻守卫,在有害动作执行前拦截长程智能体风险arXiv2607.19913发表7月22日层应用层场景AI Agent被测模型Vanguard防御监控与审计攻击提示注入风险Agent 危险操作组件监控器深度解读完整解读
防御arXiv 2609.22949·9月19日多智能体系统提示注入威胁模型与防御架构:14 类攻击向量与四类防御提出多智能体提示注入威胁模型与四层架构防御arXiv2609.22949发表9月19日层应用层场景多智能体被测模型GPT-4o (2024-08-06)、Claude 3.5 Sonnet、Llama 3 70B-Instruct防御指令与数据隔离攻击提示注入组件权限与沙箱+2+2深度解读完整解读