跳到正文
10月10日 · 周六

全部论文

找到 4 篇
筛选3
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 194 篇还没打标签,不在筛选结果里。

另有 194 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 防御arXiv 2608.24017

    WebMCP-Phalanx:为浏览器内 LLM Agent 工具调用建立信任边界

    提出 WebMCP-Phalanx,用能力凭证与双智能体隔离浏览器工具调用

    发表
    场景
    web agent
    摘要Phalanx 用浏览器凭证绑定工具所有权,Q/P 分离拦住描述注入,工具名与返回值仍有残留。

    WebMCP-Phalanx针对浏览器里的 WebMCP 智能体:在 SOP 下补工具所有权,并把语义检查从有工具权的执行中分开。

    深度解读完整解读
  2. 攻击arXiv 2605.08310

    WebTrap:针对浏览器 Agent 导航过程的中途劫持注入攻击

    提出 WebTrap 三阶段陷阱,中途劫持浏览器 Agent 完成攻击后再返回用户任务

    发表
    场景
    web agent
    被测模型
    DeepSeek-V3.1-Terminus、Gemini-2.5-Flash、GLM-4.5-Air 等 5 个
    摘要WebTrap 把攻击目标嵌进用户流程中途执行再返回。

    WebTrap 是针对长程网页与文件导航的中途劫持注入,目标是在完成攻击动作后仍回到用户任务。

    深度解读完整解读
  3. 评测与基准arXiv 2512.23128

    牛津等发布 TRAP 基准

    构建 TRAP 基准,评测网页 Agent 被界面提示注入劫持任务的情况

    发表
    场景
    web agent
    被测模型
    GPT-5、Claude Sonnet 3.7、Gemini 2.5 Flash 等 6 个
    摘要论文提出了基于五维模块化攻击空间的 TRAP 基准,评估了六个模型在真实网页环境中的注入风险。

    研究定位:针对网页自主智能体易受外部界面提示注入攻击的问题,构建了基于真实网站克隆的模块化评测基准 TRAP。

    深度解读完整解读
已经到底了