其他arXiv 2608.14611
2026 新加坡 AI 安全研究优先级共识:聚焦社会韧性与自主 AI 智能体风险
综合技术 AI 安全研究优先级,提出社会韧性支柱与智能体风险管理原则
- arXiv
- 2608.14611
- 发表
- 层
- 应用层
- 场景
- AI Agent
另有 4 篇还没有研究类型,暂不在这些分类里。
综合技术 AI 安全研究优先级,提出社会韧性支柱与智能体风险管理原则
梳理多个中等强国司法辖区的通用人工智能治理条款
补读中。
用 GIRAI 评估各国负责任 AI 治理的框架、实施与能力缺口
作者主张前沿实验室现在就开始托管嵌入式评估,至少覆盖内部智能体监控、权限控制与模型对齐,并持续评估、至少每季公开详细报告。
嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。