跳到正文
原文
arXiv:Agent 与 MCP 安全· arXiv:2609.26900· Reshabh K Sharma·· 9 天前

Ajar:在 AgentDojo 上测量 Agent 防御中未关闭的权限

Ajar: Measuring Open Privilege in Agent Defenses

AI 导读

Ajar 提出一种直接测量 Agent 防御中开放权限的评测方法,它挂载在已有的 Agent 安全基准上,复用其任务、工具 schema、参考解和目标状态,为每个良性任务构造任务并不需要的候选工具调用,并在 Agent 可行动的每个节点把这些调用提交给防御方,允许其中任何一个即意味着权限被开放。作者将 Ajar 接入 AgentDojo,使开放权限成为攻击成功率与良性效用之外的第三个维度,并测试了 Progent、CaMeL、AC4A、Permission Assistant 和 Claude Code 的 Auto mode 五种防御。

阅读原文arxiv.org