跳到正文
10月8日 · 周四

隐私与数据泄露 · 论文

找到 11 篇
筛选
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 112 篇还没打标签,不在筛选结果里。

另有 77 篇还没有研究类型,暂不在这些分类里。

  1. 攻击arXiv:2607.05189 ·

    研究者提出 MemGhost,对持久化个人 Agent 实现隐蔽记忆注入

    提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆

    AI Agent测试GPT-5.4、Claude Sonnet 4.6、Claude Sonnet 4.5 等 6 个应用层
    摘要总结了论文的研究背景、双代理优化方法 MEMGHOST、全周期实验结果以及作者对记忆信任边界的启示。

    本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。

    完整解读
  2. 评测/基准arXiv:2609.08901 ·

    论文揭示 BatchNorm 架构下机器遗忘评测的归一化伪影

    作者指出 BatchNorm 运行统计会把遗忘准确率测低,一次不改权重的 retain 前向即可把表面遗忘翻回来。

    测试ResNet-18、ResNet-50、ViT-S/16 等 4 个
    摘要一次不改权重的 BN 重校准能翻转多数方法的表面遗忘,但不改变权重里的编码器泄露。

    BN illusion 是作者对近似机器遗忘评测中一种 BatchNorm 测量伪影的命名:不改权重、只用 retain 数据重算运行统计,就可以把表面遗忘准确率翻过来。

    完整解读
  3. 评测/基准arXiv:2609.33481 ·

    IDUnlearn-Bench:面向视觉语言模型的个体级遗忘基准

    论文提出 IDUnlearn-Bench,评测 VLM 个体级多模态遗忘。Forget-5 下直接答案抑制常留下身份访问与重构路径。

    测试Qwen3-VL-2B、Qwen3-VL-4B、Qwen3-VL-8B 等 6 个
    摘要IDUnlearn-Bench 用四族探针显示:压低直接属性访问后,身份仍常能被反向查出、绑定或重构。

    IDUnlearn-Bench 评测 VLM 是否忘掉一个可跨模态识别的人,而不只是答不出某条监督事实。

    完整解读
已经到底了