跳到正文
10月9日 · 周五

前沿安全框架 · 论文

找到 6 篇
筛选6
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 1 篇还没打标签,不在筛选结果里。

另有 1 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2609.03178

    论文梳理 AI 风险建模的开放问题:从 22 位专家研讨会提炼研究议程

    梳理 AI 风险建模开放问题并比较两类定量提案

    发表
    场景
    AI Agent
    摘要研讨会议程论文:比较两类建模提案,并列出结构、证据、验证与治理上的开放问题。

    这是一份面向研究者与政策实践者的议程论文:先进 AI 的社会风险需要定量建模,但监管要求的先进方法尚未被定义。

    深度解读完整解读
  2. 其他arXiv 2609.25413

    论文提议前沿 AI 开发者开展嵌入式评估

    主张开展嵌入式评估,审查内部智能体监控、权限与模型对齐

    发表
    场景
    AI Agent
    摘要论文建议前沿开发者现在就以接近员工的现场访问,持续审查内部监控、权限与对齐。

    嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。

    深度解读完整解读
已经到底了