攻击arXiv:2608.29381 · 8月30日研究者提出 Agent 检查点回滚的五类安全失效,并在 Hermes、Cline、LangGraph 上实现三种攻击提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障AI Agent·测试DeepSeek-v4·应用层Agent 危险操作权限与沙箱摘要论文系统研究了智能体 C/R 的安全性,分析了合法回滚破坏执行连续性的机理,并实证评估了其普遍性与危害。完整解读
攻击arXiv:2607.12340 · 7月14日研究:LLM Agent 技能名幻觉率最高达 62%,可被抢注用于供应链攻击提出技能名抢注攻击,利用智能体虚构技能名劫持技能供应链编程 Agent·测试GLM-4.5-Air、GPT-5.4-mini、Claude Sonnet 4.6 等 10 个·应用层投毒与后门幻觉与编造诱导选用MCP 与技能+1+1摘要研究证实智能体虚构技能名具有高发生率与可预测性,现有防御难以兼顾安全与效用,亟需注册表结构性防护。本研究系统揭示了大模型智能体技能推荐场景下的虚构技能名称安全风险,将其形式化为一种新型供应链抢注攻击。完整解读