防御arXiv 2609.02127
论文提出带类型溯源与断言护栏,防止持久化 AI Agent 把不可信输入当作自身历史
提出类型化溯源与断言护栏,约束持久 Agent 的自传断言释放
- arXiv
- 2609.02127
- 发表
- 层
- 应用层
- 场景
- AI Agent
提出类型化溯源与断言护栏,约束持久 Agent 的自传断言释放
提出 SYNCHAIN,诱导计算机使用 Agent 自合成潜伏技能并跨任务触发
摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。
提出任务绑定令牌与策略预言机,在多智能体流水线中拦截未授权执行
作者在一条会改写沙箱邮件库的四智能体流水线上,检查低权限失陷会不会变成未授权的真实动作。