防御arXiv 2609.02127·9月2日论文提出带类型溯源与断言护栏,防止持久化 AI Agent 把不可信输入当作自身历史提出类型化溯源与断言护栏,约束持久 Agent 的自传断言释放arXiv2609.02127发表9月2日层应用层场景AI Agent防御指令与数据隔离攻击投毒与后门组件记忆+2+2深度解读完整解读
防御arXiv 2609.17648·9月15日多智能体 LLM 流水线中的信任传播与结构隔离提出任务绑定令牌与策略预言机,在多智能体流水线中拦截未授权执行arXiv2609.17648发表9月15日层应用层场景多智能体测试gemma4:31b-cloud防御权限与审批攻击投毒与后门组件权限与沙箱+2+2摘要结构性授权拦住了记忆投毒的未授权执行,持密钥时承重的是策略预言机。作者在一条会改写沙箱邮件库的四智能体流水线上,检查低权限失陷会不会变成未授权的真实动作。深度解读完整解读