跳到正文
10月10日 · 周六

全部论文

找到 2 篇
筛选5
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 194 篇还没打标签,不在筛选结果里。

另有 194 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 攻击arXiv 2609.12448

    GraphProfiler 用个人知识图谱推断敏感属性并溯源到具体帖子

    提出 GraphProfiler,用个人知识图谱从帖子历史推断敏感属性并溯源

    发表
    摘要GraphProfiler 用源链接个人知识图谱做属性推断,准确率接近文本基线,并把证据定位到少量源帖。

    GraphProfiler 是一个可审计的 LLM 敏感属性画像器:用源链接个人知识图谱,把推断落到具体帖子。

    深度解读完整解读
  2. 攻击arXiv 2602.18514

    招聘中的特洛伊木马:标准模型与推理模型间接提示注入的红队测试案例研究

    用简历中的不可见指令做间接提示注入,操纵招聘推荐

    发表
    被测模型
    Qwen 3 30B A3B Instruct 2507、Qwen 3 30B A3B Thinking 2507

    摘要作者称推理在简单注入下会帮攻击圆谎,在不合逻辑的复杂注入下又会把欺骗漏出来。

    深度解读完整解读
已经到底了