评测与基准arXiv 2610.01508
OverAct:衡量并缓解 LLM 工具调用智能体的主动越权取数
发布 OVERACT 衡量工具调用智能体的主动越权取数,并用 SELFAUDIT 缓解
- arXiv
- 2610.01508
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- Qwen3.6-Flash、Qwen3.6-Plus、Qwen3.7-Max 等 7 个
- 防御权限与审批
- 风险Agent 危险操作
摘要七模型普遍超额调用。
七个来自四个家族的工具调用模型,在保守的字面授权准则下会检索超出请求的私人数据。作者把该行为称为 proactive over-authorization,用 OVERACT 做无 LLM 评审的测量,并用 SELFAUDIT 做不依赖 oracle 的执行前过滤。