评测与基准arXiv 2609.08789
研究提出「静默修订率」
提出静默修订率,量化安全框架未披露的实质变更
- arXiv
- 2609.08789
- 发表
- 场景
- 模型与 API
- 测试
- Anthropic (Responsible Scaling Policy)
摘要系统量化了前沿 AI 安全框架的静默修订,发现多数变更为削弱且未予披露,建议监管要求逐项列举。
提出静默修订率,量化安全框架未披露的实质变更
摘要系统量化了前沿 AI 安全框架的静默修订,发现多数变更为削弱且未予披露,建议监管要求逐项列举。
构建 Systemic Risk Index 流水线,把公开基准映到四类系统风险并评测
梳理多个中等强国司法辖区的通用人工智能治理条款
补读中。
用 GIRAI 评估各国负责任 AI 治理的框架、实施与能力缺口