防御arXiv 2609.11757
研究者披露 AP2 支付协议的 Whisper 提示注入攻击并提出 A-VIP 防御
提出 Whisper 攻击与 A-VIP 绑定防御,约束智能体支付决策
- arXiv
- 2609.11757
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- gpt-5.5、gemini-2.5-flash-lite、gemini-3.1-flash-lite 等 15 个
摘要论文揭示了 AP2 协议决策层受操纵的风险,提出结构化与权能绑定防御 A-VIP,并发布评测基准。
提出 Whisper 攻击与 A-VIP 绑定防御,约束智能体支付决策
摘要论文揭示了 AP2 协议决策层受操纵的风险,提出结构化与权能绑定防御 A-VIP,并发布评测基准。
提出 COBRA 双 LLM 架构,防御计算机使用智能体的分支转向攻击
摘要提出分支转向防御架构 COBRA,通过事前能力约束与边界代理消除分支转向攻击并兼顾效用。
提出 EvoSafeHarness,为冻结模型与目标域自动搜索安全 harness
提出 VAC,用真实操作参数与来源隔离保护智能体浏览器确认
提出 ActGov,在工具执行前用确定性策略拦截间接提示注入
提出 ToolFence 能力级授权,执行前编译蓝图并确定性拦截工具调用