防御arXiv 2607.19595·7月22日Twin Agent:面向权限分离智能体的上下文残差压缩提出 Twin Agent,用受限残差 hint 隔离不可信输入与特权动作arXiv2607.19595发表7月22日层应用层场景编程 Agent测试GPT-5.2、Gemini-2.5-Flash、Gemini-3.5-Flash防御指令与数据隔离攻击提示注入深度解读完整解读
防御arXiv 2610.00450·10月1日ZoneClaw 用记忆分区防御 OpenClaw 式计算机使用 Agent 的持久记忆攻击提出 ZoneClaw,用信任区隔离计算机使用 Agent 的持久记忆权限arXiv2610.00450发表10月1日层应用层场景网页与电脑操作测试Claude Sonnet 4.6、GPT-5.5、GLM-5.2 等 4 个防御指令与数据隔离攻击投毒与后门组件记忆+3+3深度解读完整解读