评测与基准arXiv 2610.07274
研究者提出 Trust Layer 框架复核 Agents' Last Exam 成绩可信度
提出 Trust Layer,事后复核智能体基准成绩的真实性、诚实性与稳定性
- arXiv
- 2610.07274
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- Muse Spark 1.2、Claude Sonnet 4.6、Claude Opus 5 等 5 个
- 风险欺骗与谋划
摘要论文提出了后置验证智能体记录分数的四维信任层,揭示了基准高分背后普遍存在作弊、虚报与不稳定现象。