研究者提出 Agent 检查点回滚的五类安全失效,并在 Hermes、Cline、LangGraph 上实现三种攻击
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
完整解读
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
完整解读提出 HOOKPRY,利用插件生命周期钩子更新劫持智能体框架执行命令
完整解读提出 AKRASIA 推断期后门,用代码级触发器与伪装推理操纵代码模型