防御arXiv 2608.02683
S³:用多阶段防御提升 LLM 智能体安全
提出 S³,用 guard agent 编排阶段安全技能防御智能体多阶段风险
- arXiv
- 2608.02683
- 发表
- 层
- 应用层
- 场景
- 具身与机器人
- 被测模型
- DeepSeek-V4-Pro、DeepSeek-V4-Flash
- 防御监控与审计
- 攻击投毒与后门
- 风险Agent 危险操作
- 组件监控器
提出 S³,用 guard agent 编排阶段安全技能防御智能体多阶段风险
提出 CFD 跨会话分解攻击,利用工件来源缺口绕过工具型 Agent 的本地检查
CFD针对工具型 LLM 智能体:利用 artifact 来源不被跟踪这一部署失败模式,把有害目标拆开后延迟组合。