防御arXiv 2610.04504·10月3日论文提出 VAL 框架:相同 ASR 的 LLM Agent 防御可能对应不同安全保证提出 VAL 框架并用确认门与参数沙箱约束高风险工具调用arXiv2610.04504发表10月3日层应用层场景AI Agent测试DeepSeek-chat、Meta Llama 3.1 8B、Kimi防御权限与审批攻击提示注入组件权限与沙箱深度解读完整解读
防御arXiv 2608.02683·8月3日S³:用多阶段防御提升 LLM 智能体安全提出 S³ 多阶段防御,由 guard agent 编排阶段安全技能检测并缓解风险arXiv2608.02683发表8月3日层应用层场景AI Agent测试DeepSeek-V4-Pro、DeepSeek-V4-Flash防御监控与审计攻击投毒与后门风险Agent 危险操作组件监控器+3+3深度解读完整解读