其他arXiv 2610.07459
论文提出 AI Agent 声明的可审计性框架
提出 AI Agent 主张的可审计性框架与裁决规则
- arXiv
- 2610.07459
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 组件权限与沙箱
摘要主张须事先固定四要素。
作者给出把关于已部署智能体的主张写成可核查陈述的条件,而不是检测器或攻击方法。
提出 AI Agent 主张的可审计性框架与裁决规则
作者给出把关于已部署智能体的主张写成可核查陈述的条件,而不是检测器或攻击方法。
用均值场博弈分析多智能体集体攻击何时不是均衡
摘要结构阈值给出干预杠杆。
提出 statepoint 运行时,一致回滚并分支 Agent 的本地与远程状态
Planarian 是与现有 harness 协同的运行时,把智能体环境收成可恢复、可分支的时间点。
作者提出 Issuer-Sovereign Agentic Payments,由发卡行决定是否生成认证值。论文无实验。
Issuer-Sovereign Agentic Payments 把智能体消费限额留在发卡行认证步骤里,而不是在扣款时依赖银行外的 credential provider。
提议前沿开发者托管嵌入式评估,审查内部智能体监控、权限与对齐
嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。
综述工具调用 Agent 的授权架构,提出主体层级与结构要求
这是一篇关于工具调用型智能体授权架构的结构化叙事综述,分析单位是每一次使模型之外系统产生效果的调用。
提出结合 Scientist AI 监督与系统级控制的智能体保障架构
Lu 与 Bengio 给出的是一套可逐层上移的保障架构和一组事件归类,不是已测量的防御系统。
提出以协调情节为单位遏制智能体协同入侵的准则
摘要立场是跨执行保留关系并约束共享状态。
部署方侧的两层证明,用来在多智能体跨部署方委托之后回答两个事后问题:谁放出了这些字节,这条跨部署方边有没有父方授权。