评测与基准arXiv:2609.09404 · 9月9日MMPIBench:多模态提示注入对六种 Agent 框架的跨框架评测用 MMPIBench 评测智能体框架的多模态提示注入AI Agent·测试Claude Opus 4.8、GPT-5.4、Gemini 3.1 Pro 等 6 个·应用层提示注入跨模态载荷视觉+1+1摘要论文提出 MMPIBench 评测多模态提示注入对智能体的影响,发现模型主导行为、尝试远超完成,音频通道缺乏防护。完整解读
攻击arXiv:2607.05189 · 7月6日研究者提出 MemGhost,对持久化个人 Agent 实现隐蔽记忆注入提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆AI Agent·测试GPT-5.4、Claude Sonnet 4.6、Claude Sonnet 4.5 等 6 个·应用层投毒与后门潜伏触发记忆+2+2摘要总结了论文的研究背景、双代理优化方法 MEMGHOST、全周期实验结果以及作者对记忆信任边界的启示。本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。完整解读
攻击arXiv:2608.30441 · 8月31日ECLIPSE:针对长程 Agent 系统的自演化隐蔽提示注入攻击提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹AI Agent攻击者黑盒·测试DeepSeek、GPT-4o、Claude 4.8 Opus 等 7 个·应用层提示注入自动化搜索MCP 与技能+2+2完整解读