评测与基准arXiv 2609.35408
研究揭示 LLM 交付物修订痕迹导致的无意泄露,并提出 RevLeakBench 基准
用 RevLeakBench 测量 LLM 交付物修订痕迹的无意泄露
- arXiv
- 2609.35408
- 发表
- 层
- 模型层
- 场景
- AI Agent
- 被测模型
- GPT-5.6、GPT-5.5、DeepSeek-V4-Pro 等 6 个
摘要修订痕迹让撤回项重新进入交付物。
修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。
用 RevLeakBench 测量 LLM 交付物修订痕迹的无意泄露
修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。
提出弹性沙箱基础设施 DSec,支撑大规模智能体训练
DSec 是 DeepSeek-AI 的生产沙箱平台,用来支撑从 DeepSeek V3.2 到 V4.1 的智能体 RL 与评测,而不是报告某个模型的任务准确率。