评测与基准arXiv:2609.09404 · 9月9日MMPIBench:多模态提示注入对六种 Agent 框架的跨框架评测用 MMPIBench 评测智能体框架的多模态提示注入AI Agent·测试Claude Opus 4.8、GPT-5.4、Gemini 3.1 Pro 等 6 个·应用层提示注入跨模态载荷视觉+1+1摘要论文提出 MMPIBench 评测多模态提示注入对智能体的影响,发现模型主导行为、尝试远超完成,音频通道缺乏防护。完整解读
攻击arXiv:2609.04533 · 9月4日Repeat-After-Me:针对黑盒 VLM 的自适应视觉提示注入攻击提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私AI Agent·测试Claude-Opus-4.7、GPT-5.5、Gemini-3.1-Pro 等 11 个·应用层提示注入自动化搜索视觉+1+1摘要论文提出了针对黑盒 VLM 的前缀诱导自适应视觉提示注入,在多款模型上诱发了工具调用与隐私泄露。完整解读