分析与理论arXiv 2610.00417
研究:合成数据溯源识别在改写后准确率大幅下降
检验合成数据来源识别是否等于再训练适配筛选
- arXiv
- 2610.00417
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 被测模型
- Qwen2.5-3B-Instruct、DistilRoBERTa、word TF-IDF logistic regression 等 5 个
摘要来源识别在原文上准确,改写后精确归因下降。
作者在金融风险文本上把来源识别和训练样本是否有用拆成两次测量,并写明这不是电信部署实验。
检验合成数据来源识别是否等于再训练适配筛选
作者在金融风险文本上把来源识别和训练样本是否有用拆成两次测量,并写明这不是电信部署实验。