防御arXiv:2609.11757 · 9月10日研究者披露 AP2 支付协议的 Whisper 提示注入攻击并提出 A-VIP 防御提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控AI Agent·测试gemini-2.5-flash-lite、gemini-3.1-flash-lite、gemini-3-flash-preview 等 15 个·应用层权限与审批提示注入权限与沙箱+2+2摘要论文揭示了 AP2 协议决策层受操纵的风险,提出结构化与权能绑定防御 A-VIP,并发布评测基准。完整解读
攻击arXiv:2610.05089 · 10月4日研究者披露 LiteLLM 网关跨租户干扰攻击 Cooldown Landmines提出 Cooldown Landmines 跨租户冷却干扰攻击并设计租户隔离LLM 应用·测试Qwen1.5-MoE-A2.7B-Chat、DeepSeek-MoE-16B-Chat·基础设施层权限与审批拒绝服务摘要揭示网关共享冷却漏洞,提出来源检查与租户隔离防御。完整解读
防御arXiv:2609.14003 · 9月12日FlowSeal:用信息流控制阻断 LLM Agent 的隐私泄露提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露AI Agent·测试DeepSeek-V3.2、DeepSeek-R1、GPT-4.1-mini 等 4 个·应用层指令与数据隔离提取与窃取权限与沙箱+1+1摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。完整解读
防御arXiv:2609.34518 · 9月28日SEAD 论文提出工具型 Agent 的状态视角攻击与防御方法 DART 与 SAGE提出工具智能体的状态攻击 DART 与预执行防御 SAGEAI Agent·测试GPT-5.6 Luna、GPT-5.6 Terra、Gemini 3.8 Flash 等 8 个·应用层权限与审批越狱权限与沙箱摘要论文提出状态控制框架 SEAD、攻击 DART 与防御 SAGE,实验显示执行反馈与环境探测在攻防交互中具有关键作用。完整解读