攻击arXiv:2610.09920 · 10月7日研究:多向量视觉文档索引可被反演还原页面内容提出流匹配逆向框架,从多向量视觉文档索引重构页面LLM 应用·测试Tomoro-ColQwen3-8B、ColQwen3.5-4.5B、Tomoro-colqwen3-embed-4b 等 13 个·应用层提取与窃取嵌入+2+2完整解读
攻击arXiv:2610.01365 · 10月1日ReGap:无需真实隐私数据即可通过微调重新提取模型隐私关联提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联模型与 API攻击者白盒灰盒·测试GPT-2 Small、GPT-2 Medium、GPT-2 Large 等 6 个·训练与数据层提取与窃取微调与开源权重摘要提出无真实私有监督的恢复攻击 ReGap,实验显示微调可通过自生成数据唤醒模型潜在隐私关联,突显后适应隐私风险。完整解读
攻击arXiv:2609.33985 · 9月28日研究:众包微调数据投毒可放大专有指令抽取提出主题锚点投毒,放大众包微调后的专有指令提取模型与 API攻击者黑盒·测试Qwen2.5-7B-Instruct、Qwen2.5-14B-Instruct、Llama-3.1-8B-Instruct 等 6 个·训练与数据层投毒与后门潜伏触发微调与开源权重+1+1摘要论文提出基于主题锚点的数据中毒攻击,证明低比例的中毒样本可在黑盒条件下隐蔽放大微调指令泄漏。完整解读