攻击arXiv 2609.26761
A2M:针对 MCP 生态的两阶段 Agent 劫持框架
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
- arXiv
- 2609.26761
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个
另有 296 篇论文还没打上分类标签,暂不在筛选结果里。
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
提出 HOOKPRY,利用插件生命周期钩子更新劫持智能体框架执行命令
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
提出 TRUSTFORK,评测展示身份如何劫持多智能体编排的操作权限
摘要论文提出了多智能体安全基准 TRUSTFORK,揭示展示身份如何劫持操作权威,并证明事后验证无法弥补已发生的执行破坏。
提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测
摘要论文探讨了多技能智能体系统面临的技能级联攻击风险,提出自动化红队框架与基准集,指出跨技能交互存在安全防护盲区。
构建多模态技能图像攻击基准 MMSkillRisk 并设计 NCVA
摘要论文提出 MMSkillRisk 基准与 NCVA 攻击,揭示多模态技能中教学图像潜藏指令可引发未授权操作并与良性任务共存。