跳到正文
10月8日 · 周四

智谱 · GLM · 论文

找到 4 篇
筛选

模型自身风险

防御类型

影响

系统组件

被测模型厂商

同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 6 篇还没打标签,不在筛选结果里。

另有 2 篇还没有研究类型,暂不在这些分类里。

  1. 防御arXiv:2609.22724 ·

    MATE:面向移动 Agent 的策略感知安全审计方法

    AI 导读研究者提出 MATE,一个轻量的策略条件审计器,同时编码 Agent 轨迹与自然语言安全策略,判断轨迹是否违反给定策略并给出原因。

    测试MATE-0.5B、MATE-1.5B、MATE-3B 等 8 个
    摘要MATE 用合成轨迹微调轻量审计器,在可编辑策略下判断移动智能体轨迹是否违规并给出解释。

    MATE 是面向移动 GUI 智能体的轻量策略条件轨迹审计器,在给定自然语言安全策略时判断轨迹是否违规并解释原因。

    完整解读
已经到底了