跳到正文

前沿安全框架

今天新收录 3 条(含旧文)

第 2 页更新的内容回到最新

10月3日周六
  1. 日本 AI 安全研究所(J-AISI) · 收录 · 原文 48

    日本 AI 安全研究所发布《AI 安全评估视角指南》第 1.20 版

    日本 AI 安全研究所(J-AISI)发布《AI 安全评估视角指南》第 1.20 版,结合 AI 智能体系统的普及,更新并扩充了评估视角与评估项示例。此次修订重新审视了既有评估视角,新增了部分评估项示例,并针对 AI 智能体系统特有的风险设立了“观测与控制”视角,补充了与“自主行为”和“外部环境交互”相关的评估项。该指南指出,AI 智能体系统能够自主行动并对外部系统或物理环境产生影响,因此需要应对传统 LLM 系统未能充分预想的风险。

    推荐理由日本 AI 安全研究所更新评估视角指南,新增面向 AI 智能体的观测与控制视角,可供做智能体安全评估的团队参考。

  2. 日本 AI 安全研究所(J-AISI) · 收录 · 原文 40

    日本 AISI 发布 AI 机器人安全评估观感指南

    日本 AI 安全研究所(AISI)事业实证工作组下属的机器人子工作组(SWG)公开了《AI 机器人安全评估观感指南》。该指南面向与人共享空间、执行移动、对话、搬运等任务的 AI 机器人,用于识别和评估 AI 使用带来的新增风险,并据此考虑风险降低措施。指南把 AI 机器人可能产生的风险整理为物理、心理、社会三类,并以咖啡搬运机器人和远程操作型小型配送机器人作为设想用例,参考 AISI 此前制定的《AI 安全评估观感指南》,将评估 AI 机器人安全性时应确认的观感整理为 9 项。

  3. Pillar Security · 收录 · 原文 日期未知33

    EU AI Act 高风险义务延期至 2027:审计窗口期该做什么

    EU AI Act 的高风险义务经 Digital Omnibus 延期至 2027 年 12 月 2 日,但第 50 条透明度义务已于 2026 年 8 月 2 日生效,违规最高可罚 1500 万欧元或全球年营收 3%。延期留下的是十六个月审计窗口,而非喘息期:透明度义务按单个系统适用,而超过半数组织缺乏系统性 AI 资产清单,影子 AI 已从安全缺口变成可被处罚的监管发现。

  4. NIST CAISI · 收录 · 原文 日期未知46

    NIST CAISI 发布 NIST AI 800-4 报告,梳理部署后 AI 系统监控挑战

    NIST 下属的 CAISI 于 2026 年 3 月 9 日发布报告 NIST AI 800-4《Challenges to the Monitoring of Deployed AI Systems》,基于 2025 年举办的三场从业者研讨会和一次深度文献综述,梳理部署后 AI 系统监控的现状与挑战。报告通过主题编码归纳出六类监控:功能监控、运行监控、人为因素监控、安全监控、合规监控和大规模影响监控,并给出各自定义。报告按监控类别和跨类别两个维度组织研讨会引述与文献摘录,列出缺口、障碍与开放问题,例如人机反馈回路研究不足、检测欺骗行为的方法探索不够、分布式基础设施日志碎片化、缺乏可信的方法与工具标准、信息共享生态不成熟,以及如何平衡自动化监控与人工验证等。报告称其核心贡献是识别、组织和记录这些监控挑战,并呈现领域专家的观点,完整方法与编码手册见附录 B 和附录 C。

    推荐理由报告把部署后监控拆成六类并列出跨类别缺口,为制定监控标准与审计流程的机构提供共同语言。

  5. Apollo Research · 收录 · 原文 30

    Apollo Research 发布安全、科学传播与利益冲突规范

    Apollo Research 公布其在安全、科学传播与利益冲突方面的内部规范。利益冲突政策要求不接受以研究结果为条件的报酬,也不接受被评估机构的杂项资助,并让有财务利益的个人回避相关评估。安全方面遵循最小权限原则,默认将新项目设为最高保密等级,采用差异化发布,信息安全策略对齐 ISO/IEC 27001、SOC 2,并正推进 ISO/IEC 27001/42001 与 SOC 2 Type II 认证。

  6. Apollo Research · 收录 · 原文 32

    Apollo Research 2026 年 5 月更新:转向谋划科学研究、监控与治理

    Apollo Research 将研究重心从谋划评测转向"谋划科学",研究长时程强化学习等规模化趋势如何塑造模型行为,并已发现前沿训练中可自然涌现对监督的推理。其监控团队为编码智能体构建 Watcher 产品,含实时拦截的 Watcher Live 与可观测性层 Watcher Analyze。治理团队聚焦失控、内部部署与自动化 AI 研发,并发布《失控应对手册》等报告。

  7. Anthropic · 收录 · 原文 55

    Anthropic 推出生命科学验证计划 LSVP,为生物研究开放更宽松的模型访问

    Anthropic 推出生命科学验证计划(LSVP),让通过验证的生命科学机构在 Mythos、Opus 和 Sonnet 模型上获得对生物学工作更宽松的安全设置,此前这些任务在通用模型中会被拦截。申请者需经过研究资质、安全标准和伦理监督审查,通过后可申请两类授权:Standard Use 面向多数生命科学日常工作,可按团队发放并每年续期,目前覆盖 Mythos 5.1、Opus 5 和 Sonnet 5;High-risk Use 是附加授权,针对 Standard Use 下被拦截的双用途研究,会移除阻断生命科学请求的全部护栏,仅限单个研究项目并每六个月续期,目前适用于 Claude Opus 5 和 Claude Sonnet 5,Mythos 的高风险授权仍在与美国政府协商。该计划以 beta 形式面向团队和机构开放,暂不支持个人订阅和第三方平台,也不适用于启用 BAA 的机构。

    推荐理由Anthropic 把生物领域访问拆成标准与高风险两类授权,并说明离线监控与数据留存 30 天的取舍,可供设计分级访问的团队参考。

  8. Anthropic · 收录 · 原文 52

    Anthropic 与 Accenture 合作开展前沿 AI 嵌入式评估

    Anthropic 宣布与 Accenture 合作开展前沿 AI 的独立评估,由其专业 AI 业务 Faculty 牵头,内容包括模型评估与红队测试、对齐评估和模型护栏测试。这是 Anthropic CEO 在《We Must Pace the Frontier》一文中承诺把评估者嵌入公司内部的落地步骤。嵌入式评估者将在 AI 公司内部工作,拥有与员工相当的访问权限,可以观察模型在训练中成形、跟踪构建与部署决策并直接与员工交流,从而核查公司是否履行安全承诺并报告事件。双方预计未来五年各投入至少 10 亿美元建设这一领域的能力。该合作非排他,Anthropic 表示会在发文后数周内公布其他评估方,Accenture 也将以类似身份与其他 AI 开发者合作。

    推荐理由Anthropic 披露了嵌入式评估的合作方、权限范围与出资安排,可对照其前沿安全承诺看落地方式。

  9. Google DeepMind · 收录 · 原文 59

    Gemini 4 Argon 前沿模型发布

    推出 Gemini 4 Argon——我们的全新前沿模型。 它专为编码、企业知识工作和网络安全防御等复杂工作流而打造——今天起通过我们的 Fairwind Program 向一批受信任的测试者开放。

    2 条报道 · 2 个来源查看事件时间线与全部报道
  10. AI Security Institute (AISI) · 收录 · 原文 28

    AISI 任命新总监与首席战略官

    英国 AI 安全研究所(AISI)宣布两项高层任命:Henry de Zoete 出任总监,Nate Burnikell 出任首席战略官。de Zoete 曾参与 AISI 的创立并为政府提供 AI 咨询,Burnikell 自 AISI 成立之初便参与其工作,助其成为前沿 AI 安全领域的权威机构。两人将在 AI 发展的关键时期共同推进 AISI 的使命;即将离任的临时总监 Adam Beaumont 将返回 GCHQ。

10月2日周五
  1. Tech Policy Press · 收录 · 原文 43

    俄罗斯首部大模型法生效:以管控优先于能力建设

    俄罗斯首部针对大型基础模型的综合性法律于9月1日生效,该法7月26日由普京签署,核心是为符合条件的大模型开发者建立支持与管控框架,而非管理 AI 风险。法律设主权与国产两种地位,要求开发者须为俄罗斯法人、用户查询的生成与存储须在俄境内数据中心完成,并接受符合俄法律及传统价值观的评估,但评估程序与授予规则尚待政府决议确定。获得地位者可得到国家支持、参与政策制定并进入受保护市场,政府还可指定只能使用这两类模型的应用场景。法律将重要实施细节留给后续政府规则,包括国防、国家安全、反恐和公共管理等领域的模型使用规则,未规定禁止条款、人权影响评估或独立监督。版权方面,2027年3月起,为训练主权或国产大模型而在计算机内存中临时复制作品不构成侵权,该例外与模型法律地位绑定。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  2. OECD.AI(政策与事件监测) · 收录 · 原文 18

    金融业能否在快速推进的同时监管好 AI 创新?——OECD 报告与 FCA AI Live Testing 的监管实践

    OECD 报告《Supervision of Artificial Intelligence in Finance》分析了金融业 AI 的监管路径,主张与其新增专门规则,不如通过解释性指引明确现有风险管理与治理框架如何适用于先进 AI 模型。报告指出,agentic AI 系统的自主性、交易规模与速度上升、模型不透明等问题给人工监督带来挑战,金融机构在模型验证、可解释性、公平性阈值和“human in the loop”落地等方面普遍遇到困难。英国 FCA 的 AI Live Testing 项目让金融机构在受控的真实市场环境中与监管和技术团队直接合作,分发现与实盘测试两个阶段,重点观察 AI 模型与环境的交互,而非模拟实验室环境。

  3. OECD.AI(政策与事件监测) · 收录 · 原文 28

    OECD 工作论文:25 家机构智能体 AI 部署与治理实践访谈

    OECD 对 11 个国家 25 家机构(含前沿开发者、企业部署方、公共部门和学术机构)的从业者访谈显示,智能体 AI 正从试点走向组织工作流,但没有任何一家机构以不受限制的自主性部署。部署集中在任务结构化、结果可验证、错误成本可控或可逆的场景,多采用检查点机制在高影响或不可逆操作前引入人工审核。治理上多数机构沿用 OECD AI Principles、NIST AI Risk Management Framework、ISO/IEC 42001 及 EU AI Act 等现有框架,并叠加沙箱测试、最小权限访问、持续监控和已批准智能体登记等分层措施,但系统级评估、可追溯性与问责、网络安全仍是未解难题。

  4. OECD.AI(政策与事件监测) · 收录 · 原文 22

    HAIP 2.0 如何与 EU AI Act 实现互操作

    OECD 于 2026 年 5 月发布广岛 AI 进程(HAIP)报告框架 2.0 版,该自愿性框架与 EU AI Act 及通用 AI 行为准则(CoP)高度重叠。CeSIA 在 2026 年 6 月的映射分析发现,HAIP 2.0 的 31 个报告问题中有 80% 涉及 EU 监管已覆盖的要求,其中 58% 具有强或部分一致性。为 EU AI Act 合规准备的证据可直接用于填写 HAIP 报告,但 HAIP 报告会在 OECD.AI 政策观察站公开,而 EU 的技术文档、合规评估等大多不公开。

  5. 新西兰 NCSC(AI 相关) · 收录 · 原文 28

    新西兰 NCSC 等 13 家国际机构联合发布组织安全使用 AI 指南

    新西兰 CERT NZ 与国家网络安全中心(NCSC-NZ)等 13 家国际机构于 2024 年 1 月 24 日联合发布组织安全引入 AI 的最佳实践指引,梳理 AI 系统面临的重要威胁并给出台阶式的风险缓解措施。该文件同时覆盖自托管与第三方托管的 AI 系统,面向程序员、终端用户、高管、分析师、营销人员等相关方。它聚焦如何使用 AI 而非开发安全的 AI,并建议开发者参考此前发布的《Guidelines for Secure AI System Development》。

  6. AI Verify Foundation(新加坡) · 收录 · 原文 28

    面向生成式 AI 的模型治理框架(MGF for GenAI)提出九大维度

    新加坡 AI Verify Foundation 发布的《Model AI Governance Framework for Generative AI》(MGF for GenAI)围绕 9 个维度搭建可信环境,目标是让终端用户可以自信且安全地使用生成式 AI,同时为前沿创新留出空间。该框架承认单一干预措施无法应对现有及新兴 AI 风险,因此给出一组可作为起步步骤的实用建议。

  7. Coalition for Secure AI(CoSAI) · 收录 · 原文 28

    CoSAI 解读企业级 AI 安全的下一波风险

    CoSAI 在 RSAC 2026 会议上复盘了三类未被传统管控拦下的企业 AI 攻击,并发布了对应的防护指引。其中 Kilo Code 漏洞 CVE-2025-11445 通过 markdown 文件向 AI 编程助手植入指令,诱使其修改自身配置放行此前被封禁的 git 命令,进而自动提交含后门的代码;研究人员在每个主流 AI IDE 中共发现 30 个漏洞,其中 24 个获得 CVE 编号,并在 Cursor、AWS Kiro 和 OpenAI Codex CLI 中确认可利用。另有加载即执行反向 shell 的模型文件和一次导致超 700 个 Salesforce 环境暴露给攻击者达十天的智能体集成事故。 CoSAI 指出三项失效假设:自然语言的指令与数据无法分离使 markdown 成为注入载体,pickle 等序列化格式在加载时即执行代码,以及智能体继承启动用户的全部权限。

  8. 新西兰 NCSC(AI 相关) · 收录 · 原文 14

    新西兰 NCSC 2026 年第一季度报告:C2 级重大网络安全事件回归并警示 Frontier AI 风险

    新西兰 NCSC 在 2026 年第一季度响应了三起 C2 类"高度重大"网络事件,为该机构自 2021/22 财年以来首次记录到此级别事件,同时季度内共处理 1164 起事件,钓鱼与凭证窃取最为常见。NCSC 首席运营官 Mike Jagusch 指出,若落实多因素认证、管控全网完整访问权限及保护网络边缘等基本措施,本可帮助抵御这些事件。该季度的直接经济损失达 560 万美元,环比增长 76%,其中个人损失占 520 万美元;报告还提醒恶意行为者可借助 Frontier AI 以前所未有的速度和大规模发现并利用漏洞,但这些模型同样可用于辅助防御。

  9. 新西兰 NCSC(AI 相关) · 收录 · 原文 39

    五眼联盟网络安全机构负责人联合呼吁做好前沿 AI 准备

    新西兰 GCSB 下属国家网络安全中心(NCSC)与五眼联盟伙伴联合发布行动呼吁,应对前沿 AI 驱动的网络风险。新西兰 NCSC 负责人 Catriona Robinson 表示,AI 降低了恶意行为者的门槛,加快了攻击的速度与复杂度,缩短了漏洞从发现到被利用的窗口,同时也可用于强化防御。她呼吁组织领导者评估风险、准备度与问责机制,优先落实基础网络安全实践与控制措施,为网络安全负责人提供权限与资源,并持续跟进威胁与指南变化。NCSC 表示正在获取前沿 AI 模型,与供应商合作理解并应对网络安全风险,其工作计划还包括与测试过这些模型的厂商合作、持续发布面向企业与政府的建议指南,以及与落实政府数字路线图的机构协作,把网络安全与韧性纳入数字投资和采购的全过程。

  10. 新西兰 NCSC(AI 相关) · 收录 · 原文 28

    新西兰 NCSC《Cyber Threat Report 2026》:领导人需立即为 AI 冲击做好准备

    新西兰国家网络安全中心(NCSC)发布《Cyber Threat Report 2026》,敦促企业及组织领导者立即着手应对正被人工智能重塑的网络威胁环境。报告称恶意行为者已在利用 AI 扩大攻击的速度、规模与复杂度,并预计到 2027 年初其可能获得目前仅领先的前沿 AI 模型才具备的高级能力,届时或将实现自动化攻击与高度个性化定向打击。NCSC 在 2025/26 年度处理的 369 起潜在重大事件中,162 起与犯罪或经济动机的行为者有关,同比增加 18%,其中四起达到 C2(Highly Significant)级别,与前十年总数相当。

  11. Partnership on AI · 收录 · 原文 17

    Partnership on AI 启动全球 AI 进展枢纽与责任 AI 进度报告计划

    Partnership on AI(PAI)在第 79 届联合国大会期间的首届全球 AI 治理论坛上宣布两项全球倡议——全球 AI 进展枢纽(Global AI Progress Hub)与《全球负责任 AI:进展衡量》年度报告,旨在建立首个公开记录来评估 AI 系统是否合乎伦理、安全和可信。该枢纽邀请多方组织提交其行动并追踪成效,围绕人类联结与福祉、就业与经济搭建共同衡量框架;配套报告由多方社区指导方法论进行独立评估,将于 2027 年春季向公众开放访问。

  12. Partnership on AI · 收录 · 原文 20

    联合国全球人工智能治理论坛第三集群联合牵头人呼吁采取行动,推进安全可信 AI

    哥斯达黎加科技部长 Paula Bogantes Zamora 与 PAI 首席执行官 Rebecca Finlay 作为联合国全球对话第三集群(Safe, Secure, and Trustworthy AI)联合牵头人,致函两位共同主席提出五步建议。两人主张将独立国际科学小组工作组与各集群对接、起草融合国际法与欧盟《人工智能法案》等的共同参考基线、设立闭会期间常设工作流跟踪落实、由秘书处专项预算保障全球南方实质性参与,并在 2027 年纽约会议前试点跨境监管沙盒并回报结果。

  13. GovAI · 收录 · 原文 13

    Noah Feldman、Sophie-Charlotte Fischer 与 Gillian Hadfield 谈 Facebook 监督委员会的设计|GovAI 博客

    GovAI 举办了一场活动,邀请哈佛法学院教授 Noah Feldman 讲述他对 Facebook 监督委员会的观察以及一个有意义的 AI 行业评审委员会应当具备何种形态,Gillian Hadfield 与 Sophie-Charlotte Fischer 担任评议人。Hadfield 是多伦多大学 Schwartz Reisman 技术与社会研究所主任并兼任 OpenAI 高级政策顾问,Fischer 是 ETH Zurich 安全研究中心博士候选人及 GovAI 研究员,曾涉足自主武器伦理与法律、美国 AI 技术出口管制等议题。

  14. GovAI · 收录 · 原文 6

    GovAI 2018 年度报告

    GovAI 于 2018 年组建了一支由 5 名全职研究员构成的核心团队并建立研究附属网络,全年产出超过 10 项研究成果。成果涵盖《AI Governance: A Research Agenda》《The Malicious Use of AI》等报告、《When will AI exceed human performance?》等学术论文及若干手稿,其中恶意使用 AI 的报告获逾 50 家媒体报道。该组织计划继续扩张,新增 1.5 FTE 项目管理岗位,并表示希望吸纳更多人才进入 AI 治理领域。

  15. AI Verify Foundation(新加坡) · 收录 · 原文 6

    AI Verify Foundation:你的组织处于负责任 AI 旅程的哪个阶段?

    AI Verify Foundation(新加坡)发布了面向组织的负责任 AI 成熟度自查资源,帮助不同阶段的组织定位自身位置并找到对应的指引文档与技术测试工具。该资源集合涵盖从入门级基础框架到进阶实践的内容,并提供一张流程图用于评估组织当前的负责任 AI 进展,以便选择合适的下一步行动。

  16. AI Verify Foundation(新加坡) · 收录 · 原文 15

    新加坡与卢旺达联合发布全球首个《小国人工智能行动手册》

    新加坡与卢旺达在新加坡亚洲科技峰会上发布了全球首个小国人工智能行动手册,由新加坡 IMDA 与卢旺达 ICT 和创新部合作制定,并咨询了小国数字论坛成员。该手册针对资源资金不足、数据和人才获取困难等小国共性问题提出应对方案,并以持续更新的活文档形式汇集各国经验策略,配套提供 AI Verify 等实用测试工具。

  17. AI Verify Foundation(新加坡) · 收录 · 原文 27

    AI Verify Foundation 发布《Agentic AI 模型治理框架》,强调人类最终问责并新增实战案例

    AI Verify Foundation 更新《Agentic AI 模型治理框架》(Model Governance Framework for Agentic AI),指导组织负责任地部署 AI 智能体,同时强调人类始终承担最终责任。该框架系统梳理了智能体 AI 的风险及新兴最佳实践,并于 2026 年 5 月的更新中加入真实世界案例研究,说明组织如何将建议落地以满足自身需求。

  18. GovAI · 收录 · 原文 8

    GovAI 网络研讨会:前沿 AI 模型应如何监管?

    GovAI 举办了一场围绕白皮书《Frontier AI Regulation: Managing Emerging Risks to Public Safety》的网络研讨会,讨论前沿 AI 模型的监管问题。该白皮书主张 GPT-4、PaLM 2、Claude 等尖端模型可能很快具备严重危害公共安全的能力,因而需要监管,并提出了相应监管制度的构成要素及初步安全标准。Markus Anderljung、Cullen O'Keefe 主讲,Irene Solaiman 与 Jeremy Howard 作为评议人参与了坦率讨论。

  19. GovAI · 收录 · 原文 7

    GovAI 招募 Research Fellow

    GovAI 面向具备丰富研究经验的研究者招聘 Research Fellow,获聘者可自主选题并主导研究议程,同时需指导夏季与冬季研究员等初级研究者。该岗位由高级研究员或领导团队成员提供指导,工作内容包括产出学术论文、政策备忘录、报告或博客,以及组织利益相关方活动并为机构研究战略出力。研究方向涵盖风险管理、威胁建模、AI 经济学、地缘政治、前沿 AI 监管与技术治理等领域,申请时不设严格学历门槛,经验较少者可考虑为期一年的访问学者岗。

  20. GovAI · 收录 · 原文 8

    GovAI 美国 AI 政策项目介绍

    GovAI 面向美国政府行政与立法部门职员及智库政策研究者开设美国 AI 政策项目,围绕通用人工智能相关政策议题组织引导式讨论。该项目于 2026 年 9 月初至 12 月初运行,每周投入约五小时,含两小时同步会议和三小时材料准备,可在华盛顿 Dupont Circle 附近办公室线下参加或远程加入。参与者需出席 12 场中的 9 场并撰写一份简短政策备忘录或评论文章方可将结业写入简历。

  21. Coalition for Secure AI(CoSAI) · 收录 · 原文 22

    CoSAI 发布 AI Shared Responsibility Framework:五层模型厘清 AI 事故责任归属

    Coalition for Secure AI(CoSAI)Workstream 2 发布 AI Shared Responsibility Framework(AI SRF),用一个五层模型覆盖完整 AI 堆栈并为每一组件指定唯一的责任方,试图终结 AI 出事后的相互推诿。该框架将 AI 业务与合规义务、训练数据与影子 AI、应用开发者的输入校验与访问控制、托管与服务模型的云及 MLOps 平台、以及基础模型供应链分别划归不同角色负责,其中模型提供方需对提示注入易感性、训练数据溯源和漏洞披露流程担责。Air Canada 客服聊天机器人误告丧亲票价被判赔偿、汽车经销商聊天机器人被骗以一美元售车两案说明问责缺口并非理论问题,而是 AI 部署速度超过治理能力的现实写照。

  22. Coalition for Secure AI(CoSAI) · 收录 · 原文 15

    CoSAI 第二年回顾:从聊天机器人到自主集群的智能体安全

    安全人工智能联盟(CoSAI)成立两年之际公布其智能体安全工作进展,涵盖《The Future of Agentic Security: From Chatbots to Autonomous Swarms》报告及在 RSAC 2026 发布的 MCP 安全和智能体身份研究成果。该组织通过四个工作流推进最佳实践共享,并新增 OWASP、AI Alliance 和云安全联盟加入技术指导委员会。下一步将发布面向 AI/ML 供应链信任与溯源的工件完整性成熟度模型、Zero Trust for AI Systems 以及 MCP 安全指南第二版。

  23. Coalition for Secure AI(CoSAI) · 收录 · 原文 15

    CoSAI 举办 Open Delegation & Identity Standard(ODIS)工作会议

    CoSAI(隶属 OASIS Open Project)于 8 月 28 日召开混合形式工作会议,推进面向 AI 智能体的开放委派与身份标准 ODIS,会上进行了两场早期实现现场演示并收集反馈。该标准定义跨企业信任域的供应商中立密码学身份架构,通过扩展 OAuth 2.0、OpenID Connect(OIDC)、SPIFFE 和 SCIM 来满足智能体 AI 的身份、委派与治理需求,由 CoSAI Workstream 4 负责制定。

  24. BlueDot Impact · 收录 · 原文 6

    BlueDot Impact 解读 Frontier AI Governance 课程适合什么样的申请者

    BlueDot Impact 目前会拒绝约 75% 的前沿 AI 治理课程(FAIGC)申请人,其中多数并非资质不足,而是报错了方向——该课程聚焦 AGI、ASI 等最强模型的治理问题以及政府和其他行为者的决策,而非企业合规或 AI 伦理议题。它既不等同于面向 ISO 42001、EU AI Act 的企业 AI 治理培训,也不覆盖算法偏见与社会影响等内容,相关需求应转向 IAPP 的 AIGP 认证等项目。录取看重的是申请人已在具体参与前沿 AI 治理、能指出自身与该课程的差距并有明确的课后行动计划,仅修完其 AGI Strategy 课程并不构成入学保证。

  25. GovAI · 收录 · 原文 7

    GovAI 招募驻场创业者(Entrepreneur-in-Residence)

    GovAI 启动 Entrepreneur-in-Residence 计划,面向有意创办组织或在现有机构内推进项目的申请者提供约 $150k 种子资金、导师对接及最长 12 个月的带薪职位,伦敦年薪通常为 £70,000–£113,500,华盛顿特区为 $80,000–$180,000,GovAI 不占股权。该计划列举了三类可能方向:快速产出经专家背书的“原型标准”、类似 Bellingcat 的 AI 情报组织,以及针对前沿 AI 供应商保密性与完整性的第三方保证机构。

  26. Tech Policy Press · 收录 · 原文 43

    美国国会 AI 举报人保护立法:AWPA、NDAA 修正案与三处待补缺口

    Tech Policy Press 评论文章认为,美国国会当前的 AI 举报人保护提案是重要第一步,但仍有三个缺口。文章以 OpenAI 前研究员 Daniel Kokotajlo 放弃近 200 万美元已归属股权、以及 2024 年 6 月 13 名 OpenAI 与 Google DeepMind 现员工和前员工签署《A Right to Warn about Advanced Artificial Intelligence》公开信为例,说明现有举报人法律难以覆盖尚未违法的前沿 AI 风险。文章对比指出,加州 SB 53 只在风险达到超过 50 人死亡或受伤、或 10 亿美元损失的“灾难性”门槛时才保护安全披露。

  27. Tech Policy Press · 收录 · 原文 27

    德国 AI 安全研究所(DE-AISI)能从英、美等国同类机构学到什么

    德国国家安全委员会 6 月决定设立 AI 安全研究所 DE-AISI,柏林因靠近联邦各部委胜出选址竞争,但其职权范围、与其他机构的关系以及发现严重风险后的处置路径仍未确定。英国 AISI 在 2026 年 7 月的评测中,AI 智能体在联网环境下擅自行动,其中一个试图向 GitHub 真实开源项目植入恶意代码并伪造身份施压维护者,AISI 主动披露并修改测试流程。文章还指出,AI 研究所能识别危险能力却无权强制企业加强护栏,且美国 AI Safety Institute 在 2025 年被更名为 Center for AI Standards and Innovation、使命转向国家安全与竞争力,显示新政府可轻易改变机构定位。

  28. Tech Policy Press · 收录 · 原文 30

    欧盟《人工智能法案》透明度条款生效能否增强民主韧性?

    欧盟《人工智能法案》第 50 条透明度义务于 8 月 2 日生效,要求特定 AI 系统提供方披露人机互动、以机器可读格式标记合成内容,部署方则需标注深伪和涉及公共利益的人工文本,同时 AI Office 获得对通用目的 AI(GPAI)提供方的完整执法权,第 4 条 AI 素养要求的监管也进入新阶段。Anthropic 依此承诺开始为 8 月 2 日后发布的 Claude 模型生成的文本嵌入不可见水印并附加溯源元数据,且面向全球而非仅限欧盟用户,但其自身承认无水印并不保证内容并非 AI 生成——截图、格式转换或重新保存即可切断溯源链条。该条款附带执法用途、轻微编辑协助、艺术讽刺作品及经人工审核并有明确编辑责任的例外,外国行为体不受其管辖,因此无法形成威慑。