跳到正文
原文
论文追踪· arXiv:2610.06093·本站收录 · 原文发表

研究评测训练数据提取风险的跨语言迁移

Cross-Lingual Transferability of Training Data Extraction Attacks to Recover Memorized PII

AI 导读

作者评估英语为中心和多语言模型的个人信息保护,发现原本在英语条件下观察到的训练数据泄露可在部分其他语言条件下重现,迁移程度与所测模型的多语言能力相关。作者还观察到措辞变化会显著影响结果。结论限于论文所测模型、数据与语言,不代表所有个人信息都可跨语言提取。

阅读原文arxiv.org