攻击arXiv 2609.26761
A2M:针对 MCP 生态的两阶段 Agent 劫持框架
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
- arXiv
- 2609.26761
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
摘要论文系统研究了智能体 C/R 的安全性,分析了合法回滚破坏执行连续性的机理,并实证评估了其普遍性与危害。
系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
提出 PACE,在工具调用前对 Agent 做路径隔离与效果授权
PACE 是面向工具调用型 LLM 智能体的运行时调解:当准入证据无法区分会改变行为的规格时,不在出口站点上撤销调解,而在最后一次工具调用前同时检查表示出的影响路径和请求权限。
提出企业 MCP 的零信任授权扩展,拒绝提示注入下的越权工具调用
作者把零信任放在 MCP 工具调用边界:智能体即使被提示注入,也不能调用其凭证范围之外的工具。问题来自三点部署性质。调用意图会随不可信上下文改变。
提出工具调用 Agent 的拒绝钱包攻击及主机侧计费约束
这篇工作把工具调用智能体里跨轮保留、并被提供商反复计费的外部工具返回定义为 persistent billable state,并把它的主机侧再次送入决定当作控制点。。