防御arXiv 2607.13716
CAVA:面向智能体 AI 运行时治理的规范动作验证与证明
提出 CAVA,把异构智能体运行时事件规范成可哈希动作并绑定审批与回执
- arXiv
- 2607.13716
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 防御权限与审批
- 风险Agent 危险操作
- 组件权限与沙箱
摘要CAVA 用规范动作指纹承接异构运行时治理。
CAVA 是给异构智能体运行时用的动作语义层,用来回答“被批准和被审计的到底是哪一个动作”。
提出 CAVA,把异构智能体运行时事件规范成可哈希动作并绑定审批与回执
CAVA 是给异构智能体运行时用的动作语义层,用来回答“被批准和被审计的到底是哪一个动作”。
提出 SecOPD 同策略蒸馏微调,降低模型对自适应提示注入的顺从
构建 COUNTER-GEO-BENCH,评测生成式搜索对信息扭曲 GEO 的防御
摘要论文构建了针对 GEO 虚假信息的首个防御基准,揭示通用护栏的失效与反作用,并提出了有效的轻量对比检测基线。
提出类型化溯源与断言护栏,约束持久 Agent 的自传断言释放
提出 Provenance-Aware Transformers,隔离不可信来源防御间接提示注入