跳到正文
10月8日 · 周四

隐私与数据泄露 · 论文

找到 4 篇

另有 112 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 攻击arXiv:2610.01365 ·

    ReGap:无需真实隐私数据即可通过微调重新提取模型隐私关联

    提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联

    模型与 API攻击者白盒灰盒测试GPT-2 Small、GPT-2 Medium、GPT-2 Large 等 6 个训练与数据层

    摘要提出无真实私有监督的恢复攻击 ReGap,实验显示微调可通过自生成数据唤醒模型潜在隐私关联,突显后适应隐私风险。

    完整解读
  2. 攻击arXiv:2609.33985 ·

    研究:众包微调数据投毒可放大专有指令抽取

    提出主题锚点投毒,放大众包微调后的专有指令提取

    模型与 API攻击者黑盒测试Qwen2.5-7B-Instruct、Qwen2.5-14B-Instruct、Llama-3.1-8B-Instruct 等 6 个训练与数据层

    摘要论文提出基于主题锚点的数据中毒攻击,证明低比例的中毒样本可在黑盒条件下隐蔽放大微调指令泄漏。

    完整解读
已经到底了