跳到正文
原文
论文追踪· arXiv:2511.20597·本站收录 · 原文发表

BrowseSafe:研究者构建浏览器 Agent 提示注入基准并评测现有防御

BrowseSafe: Understanding and Preventing Prompt Injection Within AI Browser Agents

AI 导读

研究者发布 BrowseSafe,针对 AI 浏览器 Agent 的提示注入攻击构建基准,攻击载荷嵌入真实 HTML 环境,并强调能影响真实世界操作而非仅改变文本输出。该基准的载荷复杂度和干扰项频率接近真实场景中 Agent 遇到的情况。作者用它系统评测了现有防御在前沿 AI 模型上的效果,并提出结合架构层面与模型层面的多层防御策略,作为设计安全浏览器 Agent 的纵深防御蓝图。论文被 COLM 2026 接收。

阅读原文arxiv.org