评测与基准arXiv 2609.35408
研究揭示 LLM 交付物修订痕迹导致的无意泄露,并提出 RevLeakBench 基准
提出 RevLeakBench 测量交付物修订痕迹造成的无意泄露
- arXiv
- 2609.35408
- 发表
- 层
- 模型层
- 场景
- AI Agent
- 测试
- GPT-5.6、GPT-5.5、DeepSeek-V4-Pro 等 6 个
摘要修订痕迹让撤回项重新进入交付物。
修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。
提出 RevLeakBench 测量交付物修订痕迹造成的无意泄露
修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。
提出 CGMIA,用成员推理检测代码生成基准的数据泄漏
CGMIA 用成员推断检测代码生成基准是否泄入 LLM 训练集,使评测不依赖对训练语料的直接访问。