防御arXiv 2607.19913·7月22日Janus:面向长时程智能体安全的前瞻性潜在风险预测框架提出 Janus 前瞻守卫,在有害动作执行前拦截长程智能体风险arXiv2607.19913发表7月22日层应用层场景AI Agent防御监控与审计攻击提示注入风险Agent 危险操作组件监控器深度解读完整解读
防御arXiv 2609.22949·9月19日多智能体系统提示注入威胁模型与防御架构:14 类攻击向量与四类防御提出多智能体提示注入威胁模型与四层架构防御arXiv2609.22949发表9月19日层应用层场景多智能体被测模型GPT-4o (2024-08-06)、Claude 3.5 Sonnet、Llama 3 70B-Instruct防御指令与数据隔离攻击提示注入组件权限与沙箱+2+2深度解读完整解读
防御arXiv 2608.02683·8月3日S³:用多阶段防御提升 LLM 智能体安全提出 S³ 多阶段防御,由 guard agent 编排阶段安全技能检测并缓解风险arXiv2608.02683发表8月3日层应用层场景AI Agent防御监控与审计攻击投毒与后门风险Agent 危险操作组件监控器+3+3深度解读完整解读