跳到正文
原文
arXiv:Agent 与 MCP 安全· arXiv:2609.08371· Dimitrios Stamatios Bouras·· 24 天前

CapScope:面向编码 Agent 的抗提示注入能力范围授权机制

Authority Is Not a String: A Capability-Scoped Harness for Prompt-Injection-Resistant Coding Agents

AI 导读

研究者提出 CapScope,一种在 harness 层限制工具调用的授权机制,无需模型自行识别恶意文本。它先从可信输入推导任务级权限上限,再为每个 Agent 分配独立的能力集合,存放在模型上下文之外,每次工具调用都按发起该调用的 Agent 的能力进行检查,因此某个子 Agent 获得的权限不会自动传给另一个。作者在 Pi 编码 Agent 上实现该机制,并在一个由编排者向子 Agent 分派子任务的修复流程中评测,覆盖 5 个 Python 任务、5 个注入面、4 种授权条件和每格 3 次试验共 300 次运行。

阅读原文arxiv.org