跳到正文
原文
arXiv:后门、投毒与隐私· arXiv:2609.14649· Tan Xue·· 18 天前

CIG-MIA:利用上下文信息增益对 RAG 系统发起成员推断攻击

CIG-MIA: Context-Induced Information Gain Membership Inference Attacks against Retrieval-Augmented Generation

AI 导读

论文提出 CIG-MIA,一种基于上下文信息增益的成员推断攻击,用于判断某文档是否属于 RAG 系统的知识库,覆盖灰盒与纯文本黑盒两种访问设定。其思路是显式注入候选文档对成员与非成员影响不同:文档已可通过检索获得时注入带来的额外支持很小,文档不在库中时注入引入新证据、似然增益更大。灰盒设定下直接由 token 级似然计算该增益,黑盒设定下用轻量代理估计器结合语义相似度与精确匹配特征,从生成文本中估计同一增益。

阅读原文arxiv.org