攻击arXiv 2609.26761
A2M:针对 MCP 生态的两阶段 Agent 劫持框架
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持 Agent
- arXiv
- 2609.26761
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 被测模型
- GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持 Agent
用通用扰动对恶意软件分类器及漂移检测器做规避与后门投毒
提出 VPH 与 VTH,只改视频帧劫持世界模型并投毒下游策略
只改看似安全的视频帧,经世界模型之后才改变下游机器人策略。 问题在于世界模型进入数据生成后,数据集检查看到的仍是安全演示,合成轨迹却可以变危险。