攻击arXiv:2610.09240 · 10月7日WebMirage 用对抗图像劫持视觉网页 Agent 的浏览器操作提出 WebMirage,用对抗图像劫持视觉网页智能体的浏览器操作网页与电脑操作·测试LLaVA-v1.5-13B、LLaVA-v1.6-34B、MiniCPM-o-8B 等 6 个·应用层提示注入跨模态载荷视觉+1+1摘要论文提出了针对网络智能体的端到端视觉红队框架 WebMirage,揭示了从视觉定位到浏览器执行的安全脆弱性。WebMirage 是一个面向视觉定位网络智能体的流水线感知端到端红队攻击框架。完整解读
攻击arXiv:2610.09027 · 10月7日P-VMI:对抗图像经 KV cache 持续影响多轮对话提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出模型与 API·测试Qwen3-8B、Qwen3-VL-8B-Instruct、Gemma-4-12B 等 4 个·基础设施层提示注入潜伏触发视觉+1+1摘要论文提出 P-VMI,证实对抗输入被掩蔽后仍可经 KV 缓存持久控制模型,强调了保留状态的安全风险。完整解读
攻击arXiv:2609.27542 · 9月23日研究者用控制 token 注入删除 gpt-oss-20b 推理链并绕过思维链监控提出控制标记注入,清空工具智能体推理链以绕过思维链监控AI Agent·测试openai/gpt-oss-20b、google/gemma-4-26B-A4B-it、deepseek-ai/DeepSeek-R1-Distill-Qwen-7B 等 4 个·应用层提示注入对话结构操控推理链+2+2摘要论文阐明控制标记注入可抑制 CoT 使监控失效并促成拒绝绕过,且工具执行受解析器宽容度影响。完整解读