攻击arXiv 2609.26761
A2M:针对 MCP 生态的两阶段 Agent 劫持框架
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
- arXiv
- 2609.26761
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
提出跨目标课程强化学习,生成间接提示注入以劫持智能体
该研究针对强化学习自动化提示注入红队在攻击前沿大模型时的冷启动问题,提出了一种基于目标模型鲁棒性递进的课程强化学习方法。