跳到正文
事件持续更新

可回放工具Agent审计的声明-证据-执行绑定契约

2 篇报道2 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月2日发表的论文提出一种以声明为锚点的执行契约,将智能体输出的声明、其精确来源片段、产生该声明的有序执行前缀,以及执行时观察到的来源版本与访问状态联合绑定,用于可回放的智能体审计。每条回执包含发射锚点,可在已提交答案或带声明的动作中确定性定位该声明,并附带来源标识、偏移、哈希、引文和域分隔的执行承诺。确定性完整性验证器在接入语义或任务标签之前先重建这些绑定,作者将完整性平面与可插拔的支持平面分离,避免用结构有效性代替蕴含判断。另一篇论文提出AI Agent声明的可审计性框架,主张核查声明前须先明确政策、范围、判定记录及记录者,并在结论前固定这些要素和决策规则,称为可审计声明,将此前Auditable Agents框架中的Policy Checkability维度从单一动作扩展到声明层面;论文指出Agent还带来由独立记录覆盖、授权绑定到每个动作的参数、以及完整性之外的完备性三项额外条件,并在显式模型下证明缺少任一条件时的结果。

AI 根据报道生成 · 41 分钟前更新

事件进展

2 个进展
  1. 10月7日 11:29 · 1 篇报道
    可审计的 AI 智能体安全声明:政策、适用范围与日志义务
    论文追踪:论文提出 AI Agent 声明的可审计性框架
  2. 10月2日 12:00 · 1 篇报道
    可回放工具Agent审计的声明-证据-执行绑定契约
    arXiv:Actions with Receipts:为工具智能体审计绑定声明、证据与执行

后续时间线

报道和讨论按时间排:从发布、媒体跟进到各平台的讨论。

10月7日
  1. 论文追踪
    论文提出 AI Agent 声明的可审计性框架

    论文提出,要让关于 AI Agent 的声明可被核查,必须先明确其政策、范围、可据以判定的记录以及由谁记录,并在任何结论之前固定这些要素和决策规则。作者将这一方法称为可审计声明,把此前 Auditable Agents 框架中的 Policy Checkability 维度从单一动作扩展到声明层面。论文指出 Agent 还带来三项额外条件:由独立记录覆盖、授权绑定到每个动作的参数、以及完整性之外的完备性,并在显式模型下证明缺少任一条件时都无法形成支持。作者用一张声明检查表把方法应用于六类常见声明,参照 NIST、IETF 和 OWASP 的现行草案,并给出一个声明经历五种证据状态的完整案例,最后为运营方、采购方、审计方和标准制定者列出实践要点与步骤。

10月2日
  1. arXiv
    Actions with Receipts:为工具智能体审计绑定声明、证据与执行

    论文提出一种以声明为锚点的执行契约,把智能体输出的声明、其精确来源片段、产生该声明的有序执行前缀,以及执行时观察到的来源版本与访问状态联合绑定,用于可回放的智能体审计。每条回执包含一个发射锚点,可在已提交答案或带声明的动作中确定性地定位该声明,并附带来源标识、偏移、哈希、引文和域分隔的执行承诺。确定性完整性验证器在接入语义或任务标签之前先重建这些绑定,作者将完整性平面与可插拔的支持平面分离,避免用结构有效性代替蕴含判断。契约给出七个可独立测试的属性,包括声明与发射绑定、来源绑定、有序执行绑定、oracle 分离、持久对象回放、执行重跑一致性和版本与访问绑定。在 1280 个跨对象攻击中,联合契约检出 1275 个替换,检出率 0.9961;移除任一目标属性后,其攻击检出率降至 0.0156 至 0.0625。

相关讨论

各平台上讨论这件事的帖子和转述:不单独成文,只列链接和一句原文。72 小时的讨论链接数还含 1 篇报道,见后续时间线。

共 1 条

关注度走势

内容价值与传播共同决定关注度;传播减弱时回落到内容价值。

每天新增来源

6 天共 3 个·最多 1(10月2日)·今天 1

  • 10月2日 新增 1 个来源(1 家媒体、0 个账号)
  • 10月3日 新增 1 个来源(0 家媒体、1 个账号)
  • 10月4日 新增 0 个来源(0 家媒体、0 个账号)
  • 10月5日 新增 0 个来源(0 家媒体、0 个账号)
  • 10月6日 新增 0 个来源(0 家媒体、0 个账号)
  • 10月7日 新增 1 个来源(1 家媒体、0 个账号)

每小时关注度

还没有足够的连续观测数据,暂不绘制趋势。