跳到正文
10月8日 · 周四
  1. 攻击arXiv:2610.02373 · 53

    HDI 攻击:篡改 GraphRAG 辅助结构可致 88–94% 攻击成功率

    论文针对 GraphRAG 辅助模式级实体提出跳衰减影响攻击,篡改 0.016% 结构使 HippoRAG2 达到 94.44% ASR。

    • 94.44%HippoRAG2在2WikiMHQA下的HDI-C攻击ASR(Table 1)
    • 91.69%MSGraphRAG在HotpotQA下的HDI-T攻击ASR(Table 1)
    • 0.016%HippoRAG2在2WikiMHQA下的修改结构比例(Table 2)
    6 问速览论文指出现有图投毒局限于实例级,提出了针对 GraphRAG 辅助模式级实体的攻击方法。
    1. 这篇论文试图解决什么问题?

      论文指出现有图投毒局限于实例级,提出了针对 GraphRAG 辅助模式级实体的攻击方法。

    2. 有哪些相关研究?

      论文梳理了 GraphRAG 架构、实例级图投毒及语言防御研究,指出现有工作忽视模式层。

    3. 论文如何解决这个问题?

      论文通过跳衰减影响算法筛选核心节点,并以 3S 框架实施语义、结构与打分机制篡改。

    4. 论文做了哪些实验?

      实验在两套基准和架构上展现了超 88% 的攻击成功率与高达 6.00 的模式杠杆率。

    5. 有什么可以进一步探索的点?

      作者指出了写权限假设、防御评估单一与模型泛化未测等局限,并列出后续防御方向。

    6. 总结一下论文的主要内容

      论文形式化了 GraphRAG 辅助模式级实体攻击面,提出 HDI 攻击并验证其攻击效果。

    完整解读
  2. 攻击arXiv:2609.03884 · 59

    HookPry:利用插件生命周期钩子更新劫持 AI Agent 框架

    HOOKPRY利用插件生命周期钩子更新机制对7个智能体框架实施供应链攻击,在1000次运行中微平均E2E-ASR达77.0%。

    • 77.0%1000次跨框架与后端运行微平均E2E-ASR(Table 2)
    • 92.5%Hermes框架跨后端平均E2E-ASR(Table 2)
    • 52.5%Claude Code跨后端平均E2E-ASR(Table 2)
    6 问速览智能体框架信任插件钩子更新,使攻击者可通过版本更新在模型推理流外静默执行恶意命令。
    1. 这篇论文试图解决什么问题?

      智能体框架信任插件钩子更新,使攻击者可通过版本更新在模型推理流外静默执行恶意命令。

    2. 有哪些相关研究?

      现有工作主要关注提示注入、工具描述投毒与恶意代码,未系统研究框架层生命周期钩子的信任迁移。

    3. 论文如何解决这个问题?

      HOOKPRY 通过对抗清单优化提升检索、时间解耦定位弱验证边界、最小公共接口跨框架编译原生钩子配置。

    4. 论文做了哪些实验?

      1000次跨环境测试微平均E2E-ASR达77.0%,原生钩子攻击效果显著优于MCP投毒,静态防御漏报47.5%。

    5. 有什么可以进一步探索的点?

      作者指出安装采纳率未测及环境未穷尽等局限,未来可探索动态分析、最小特权钩子与更新授权机制。

    6. 总结一下论文的主要内容

      论文揭示了智能体框架钩子更新的供应链攻击面,提出了 HOOKPRY 框架并在测试中取得 77.0% 的成功率。

    完整解读
已经到底了