评测与基准arXiv 2610.04378
COPEX:面向 MCP 智能体的受控攻击评测基准发布
提出 COPEX 基准,固定协议栈评测 MCP 智能体的攻击抵抗力
- arXiv
- 2610.04378
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- Llama-3.2:3b、Claude Opus 4.7、Claude Sonnet 4.6 等 9 个
另有 268 篇论文还没打上分类标签,暂不在筛选结果里。
提出 COPEX 基准,固定协议栈评测 MCP 智能体的攻击抵抗力
提出跨通道分段攻击,利用 MCP 隐式信任诱导外发敏感文件
摘要论文揭示了 MCP 多通道隐式信任层级,通过跨通道分段与协议级利用突破现有防御,展示了严重的凭证外发风险。
提出 ISM,用语义匹配隐式操纵 Agent 技能选择
提出 ContextLeak,用强化学习生成恶意工具描述以诱导 Agent 外泄上下文