跳到正文
原文
arXiv:Agent 与 MCP 安全· arXiv:2609.15397· Artem Trofimov·· 17 天前

论文:工具调用成功但工作流失败,智能体与工具边界的八类异常

When Tool Calls Succeed but Workflows Fail: Anomalies at the Agent-Tool Boundary

AI 导读

论文提出效应历史模型,把外部世界发生的事件与运行时对事件的观察区分开,并归纳出八类反复出现的外部效应异常。在重试、推测执行、并发和部分失败下,必需效应可能缺失或重复、已中止的效应可能残留、已提交的效应可能依赖随后被撤回的临时状态。作者据此推导出排除每类异常所需的边界能力,并指出仅靠黑盒工具调用无法提供通用保证的四个位置。随后作者测量了已注册 MCP 服务器暴露的 98291 个工具对标准注解词汇的使用情况,发现这些字段被广泛输出,但只提供粗粒度的调用级提示,所需能力无一能被完整表达,因此提出在工具边界引入可复用的交易契约。

阅读原文arxiv.org