风险行为arXiv 2609.20942·9月18日当 AI 评审训练 AI 评审:科学判断坍缩与 TrustReviewer 缓解方案测量合成审稿训练导致的科学判断坍缩并提出 TrustReviewer 缓解arXiv2609.20942发表9月18日层训练与数据层场景模型与 API被测模型M2 0%、M2 33%、M2 66% 等 6 个防御模型加固+1+1摘要一步递归里合成审稿会收窄判断。深度解读完整解读