跳到正文
原文
arXiv:Agent 与 MCP 安全· arXiv:2609.28585· Jinqian Zhang·· 8 天前

论文提出持久计费状态概念,揭示工具调用 LLM Agent 的拒绝钱包攻击与防御

Persistent Billable State: Denial-of-Wallet Attacks and Defenses in Tool-Calling LLM Agents

AI 导读

中科院信息工程研究所等机构的研究者提出持久计费状态概念,指工具调用 LLM Agent 的运行时把外部工具返回内容带入后续模型输入后,提供方会对其重复计费,被接纳的恶意或被攻陷工具因此可在没有受害者凭证和本地运行时权限的情况下,把不可信数据转化为持续由受害者付费的处理。作者把主机对这类内容是否以及如何进入后续计费上下文的决策形式化为持久计费状态边界,并称这是对该准入后生命周期的首个系统性安全研究。研究推导出六种拒绝钱包攻击向量,构建端到端测试框架 DOW-BENCH,在六个模型家族上完成 243 次执行,用量遥测显示单会话累计输入最高达到该会话首次调用输入的 14,293 倍。

阅读原文arxiv.org