其他arXiv 2609.03178
论文梳理 AI 风险建模的开放问题:从 22 位专家研讨会提炼研究议程
梳理 AI 风险建模开放问题并比较两类定量提案
- arXiv
- 2609.03178
- 发表
- 层
- 应用层
- 场景
- AI Agent
摘要研讨会议程论文:比较两类建模提案,并列出结构、证据、验证与治理上的开放问题。
这是一份面向研究者与政策实践者的议程论文:先进 AI 的社会风险需要定量建模,但监管要求的先进方法尚未被定义。
梳理 AI 风险建模开放问题并比较两类定量提案
这是一份面向研究者与政策实践者的议程论文:先进 AI 的社会风险需要定量建模,但监管要求的先进方法尚未被定义。
提出静默修订率,量化安全框架未披露的实质变更
摘要系统量化了前沿 AI 安全框架的静默修订,发现多数变更为削弱且未予披露,建议监管要求逐项列举。
综合技术 AI 安全研究优先级,提出社会韧性支柱与智能体风险管理原则
用 GIRAI 评估各国负责任 AI 治理的框架、实施与能力缺口
主张开展嵌入式评估,审查内部智能体监控、权限与模型对齐
嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。