评测与基准arXiv 2610.04378
COPEX:面向 MCP 智能体的受控攻击评测基准发布
用 COPEX 基准在固定协议栈下评测智能体抵御 MCP 攻击的能力
- arXiv
- 2610.04378
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- Llama-3.2:3b、Claude Opus 4.7、Claude Sonnet 4.6 等 9 个
用 COPEX 基准在固定协议栈下评测智能体抵御 MCP 攻击的能力
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。