跳到正文
原文
论文追踪· arXiv:2609.12448· Ahmed Sohair Khan; Estrid He; Chenglong Ma; Monica Wachowicz; Elham Naghizade·本站收录 · 原文发表

GraphProfiler 用个人知识图谱推断敏感属性并溯源到具体帖子

GraphProfiler: Source-Linked Sensitive Attribute Inference via Personal Knowledge Graphs

AI 导读

研究者提出 GraphProfiler,一种可审计的 LLM 画像方法,将用户发帖历史表示为带来源链接的个人知识图谱,节点和边可回溯到原始帖子,属性预测可引用图谱记录和源文本。在八属性的 SynthPAI 基准上攻击成功率达 86.7%,与纯文本强基线相差不到两个百分点,在 PANDORA 上为 84.6%,超过 98% 的预测附有支持证据。消融实验显示,移除被引用的帖子比移除同等数量的随机帖子更能降低攻击成功率,说明这些帖子确实贡献了推断结果。该工作已被 EMNLP 2026 主会接收。

阅读原文arxiv.org