风险行为arXiv 2609.20942
当 AI 评审训练 AI 评审:科学判断坍缩与 TrustReviewer 缓解方案
测量合成审稿训练导致的科学判断坍缩并提出 TrustReviewer 缓解
- arXiv
- 2609.20942
- 发表
- 场景
- 模型与 API
- 测试
- Meta-Llama-3.1-8B-Instruct、M1、M2 0% 等 10 个
- 防御模型加固
摘要一步递归里合成审稿会收窄判断。
测量合成审稿训练导致的科学判断坍缩并提出 TrustReviewer 缓解
摘要一步递归里合成审稿会收窄判断。