跳到正文

前沿安全框架

实验室的前沿安全框架、负责任扩展政策与准备框架的发布和修订。

329条动态与论文相关主题政策与监管System CardAnthropic
在这个话题内搜索或按分类筛选

新闻与论文

第 61–80 条 · 共 329 条
10月2日周五
  1. Tech Policy Press · 收录 · 原文 43

    俄罗斯首部大模型法生效:以管控优先于能力建设

    俄罗斯首部针对大型基础模型的综合性法律于9月1日生效,该法7月26日由普京签署,核心是为符合条件的大模型开发者建立支持与管控框架,而非管理 AI 风险。法律设主权与国产两种地位,要求开发者须为俄罗斯法人、用户查询的生成与存储须在俄境内数据中心完成,并接受符合俄法律及传统价值观的评估,但评估程序与授予规则尚待政府决议确定。获得地位者可得到国家支持、参与政策制定并进入受保护市场,政府还可指定只能使用这两类模型的应用场景。法律将重要实施细节留给后续政府规则,包括国防、国家安全、反恐和公共管理等领域的模型使用规则,未规定禁止条款、人权影响评估或独立监督。版权方面,2027年3月起,为训练主权或国产大模型而在计算机内存中临时复制作品不构成侵权,该例外与模型法律地位绑定。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  2. OECD.AI(政策与事件监测) · 收录 · 原文 18

    金融业能否在快速推进的同时监管好 AI 创新?——OECD 报告与 FCA AI Live Testing 的监管实践

    OECD 报告《Supervision of Artificial Intelligence in Finance》分析了金融业 AI 的监管路径,主张与其新增专门规则,不如通过解释性指引明确现有风险管理与治理框架如何适用于先进 AI 模型。报告指出,agentic AI 系统的自主性、交易规模与速度上升、模型不透明等问题给人工监督带来挑战,金融机构在模型验证、可解释性、公平性阈值和“human in the loop”落地等方面普遍遇到困难。英国 FCA 的 AI Live Testing 项目让金融机构在受控的真实市场环境中与监管和技术团队直接合作,分发现与实盘测试两个阶段,重点观察 AI 模型与环境的交互,而非模拟实验室环境。

  3. OECD.AI(政策与事件监测) · 收录 · 原文 28

    OECD 工作论文:25 家机构智能体 AI 部署与治理实践访谈

    OECD 对 11 个国家 25 家机构(含前沿开发者、企业部署方、公共部门和学术机构)的从业者访谈显示,智能体 AI 正从试点走向组织工作流,但没有任何一家机构以不受限制的自主性部署。部署集中在任务结构化、结果可验证、错误成本可控或可逆的场景,多采用检查点机制在高影响或不可逆操作前引入人工审核。治理上多数机构沿用 OECD AI Principles、NIST AI Risk Management Framework、ISO/IEC 42001 及 EU AI Act 等现有框架,并叠加沙箱测试、最小权限访问、持续监控和已批准智能体登记等分层措施,但系统级评估、可追溯性与问责、网络安全仍是未解难题。

  4. OECD.AI(政策与事件监测) · 收录 · 原文 22

    HAIP 2.0 如何与 EU AI Act 实现互操作

    OECD 于 2026 年 5 月发布广岛 AI 进程(HAIP)报告框架 2.0 版,该自愿性框架与 EU AI Act 及通用 AI 行为准则(CoP)高度重叠。CeSIA 在 2026 年 6 月的映射分析发现,HAIP 2.0 的 31 个报告问题中有 80% 涉及 EU 监管已覆盖的要求,其中 58% 具有强或部分一致性。为 EU AI Act 合规准备的证据可直接用于填写 HAIP 报告,但 HAIP 报告会在 OECD.AI 政策观察站公开,而 EU 的技术文档、合规评估等大多不公开。

  5. Cohere(安全与框架) · 收录 · 原文 22

    Cohere CEO Aidan Gomez 质疑:谁有权为 AI 制定规则?

    Cohere 联合创始人兼 CEO Aidan Gomez 公开质疑少数硅谷头部 AI 公司借"安全"之名主导全球 AI 规则与安全标准,并批评 Anthropic CEO Dario Amodei 本周发布的路线图寻求反垄断豁免。Gomez 以 1975 年 SEC 指定三家评级机构、1985 年欧洲汽车行业反垄断豁免为例,指出两次以安全为名的安排最终都保护了在位者、限制了竞争。他支持对高能力 AI 系统进行独立审查,但反对由少数实验室商定标准后要求其他开发者盲从。

  6. 新西兰 NCSC(AI 相关) · 收录 · 原文 28

    新西兰 NCSC 等 13 家国际机构联合发布组织安全使用 AI 指南

    新西兰 CERT NZ 与国家网络安全中心(NCSC-NZ)等 13 家国际机构于 2024 年 1 月 24 日联合发布组织安全引入 AI 的最佳实践指引,梳理 AI 系统面临的重要威胁并给出台阶式的风险缓解措施。该文件同时覆盖自托管与第三方托管的 AI 系统,面向程序员、终端用户、高管、分析师、营销人员等相关方。它聚焦如何使用 AI 而非开发安全的 AI,并建议开发者参考此前发布的《Guidelines for Secure AI System Development》。

  7. AI Verify Foundation(新加坡) · 收录 · 原文 28

    面向生成式 AI 的模型治理框架(MGF for GenAI)提出九大维度

    新加坡 AI Verify Foundation 发布的《Model AI Governance Framework for Generative AI》(MGF for GenAI)围绕 9 个维度搭建可信环境,目标是让终端用户可以自信且安全地使用生成式 AI,同时为前沿创新留出空间。该框架承认单一干预措施无法应对现有及新兴 AI 风险,因此给出一组可作为起步步骤的实用建议。

  8. Coalition for Secure AI(CoSAI) · 收录 · 原文 28

    CoSAI 解读企业级 AI 安全的下一波风险

    CoSAI 在 RSAC 2026 会议上复盘了三类未被传统管控拦下的企业 AI 攻击,并发布了对应的防护指引。其中 Kilo Code 漏洞 CVE-2025-11445 通过 markdown 文件向 AI 编程助手植入指令,诱使其修改自身配置放行此前被封禁的 git 命令,进而自动提交含后门的代码;研究人员在每个主流 AI IDE 中共发现 30 个漏洞,其中 24 个获得 CVE 编号,并在 Cursor、AWS Kiro 和 OpenAI Codex CLI 中确认可利用。另有加载即执行反向 shell 的模型文件和一次导致超 700 个 Salesforce 环境暴露给攻击者达十天的智能体集成事故。 CoSAI 指出三项失效假设:自然语言的指令与数据无法分离使 markdown 成为注入载体,pickle 等序列化格式在加载时即执行代码,以及智能体继承启动用户的全部权限。

  9. 新西兰 NCSC(AI 相关) · 收录 · 原文 14

    新西兰 NCSC 2026 年第一季度报告:C2 级重大网络安全事件回归并警示 Frontier AI 风险

    新西兰 NCSC 在 2026 年第一季度响应了三起 C2 类"高度重大"网络事件,为该机构自 2021/22 财年以来首次记录到此级别事件,同时季度内共处理 1164 起事件,钓鱼与凭证窃取最为常见。NCSC 首席运营官 Mike Jagusch 指出,若落实多因素认证、管控全网完整访问权限及保护网络边缘等基本措施,本可帮助抵御这些事件。该季度的直接经济损失达 560 万美元,环比增长 76%,其中个人损失占 520 万美元;报告还提醒恶意行为者可借助 Frontier AI 以前所未有的速度和大规模发现并利用漏洞,但这些模型同样可用于辅助防御。

  10. 新西兰 NCSC(AI 相关) · 收录 · 原文 39

    五眼联盟网络安全机构负责人联合呼吁做好前沿 AI 准备

    新西兰 GCSB 下属国家网络安全中心(NCSC)与五眼联盟伙伴联合发布行动呼吁,应对前沿 AI 驱动的网络风险。新西兰 NCSC 负责人 Catriona Robinson 表示,AI 降低了恶意行为者的门槛,加快了攻击的速度与复杂度,缩短了漏洞从发现到被利用的窗口,同时也可用于强化防御。她呼吁组织领导者评估风险、准备度与问责机制,优先落实基础网络安全实践与控制措施,为网络安全负责人提供权限与资源,并持续跟进威胁与指南变化。NCSC 表示正在获取前沿 AI 模型,与供应商合作理解并应对网络安全风险,其工作计划还包括与测试过这些模型的厂商合作、持续发布面向企业与政府的建议指南,以及与落实政府数字路线图的机构协作,把网络安全与韧性纳入数字投资和采购的全过程。

  11. 新西兰 NCSC(AI 相关) · 收录 · 原文 28

    新西兰 NCSC《Cyber Threat Report 2026》:领导人需立即为 AI 冲击做好准备

    新西兰国家网络安全中心(NCSC)发布《Cyber Threat Report 2026》,敦促企业及组织领导者立即着手应对正被人工智能重塑的网络威胁环境。报告称恶意行为者已在利用 AI 扩大攻击的速度、规模与复杂度,并预计到 2027 年初其可能获得目前仅领先的前沿 AI 模型才具备的高级能力,届时或将实现自动化攻击与高度个性化定向打击。NCSC 在 2025/26 年度处理的 369 起潜在重大事件中,162 起与犯罪或经济动机的行为者有关,同比增加 18%,其中四起达到 C2(Highly Significant)级别,与前十年总数相当。

  12. Partnership on AI · 收录 · 原文 17

    Partnership on AI 启动全球 AI 进展枢纽与责任 AI 进度报告计划

    Partnership on AI(PAI)在第 79 届联合国大会期间的首届全球 AI 治理论坛上宣布两项全球倡议——全球 AI 进展枢纽(Global AI Progress Hub)与《全球负责任 AI:进展衡量》年度报告,旨在建立首个公开记录来评估 AI 系统是否合乎伦理、安全和可信。该枢纽邀请多方组织提交其行动并追踪成效,围绕人类联结与福祉、就业与经济搭建共同衡量框架;配套报告由多方社区指导方法论进行独立评估,将于 2027 年春季向公众开放访问。

  13. Partnership on AI · 收录 · 原文 20

    联合国全球人工智能治理论坛第三集群联合牵头人呼吁采取行动,推进安全可信 AI

    哥斯达黎加科技部长 Paula Bogantes Zamora 与 PAI 首席执行官 Rebecca Finlay 作为联合国全球对话第三集群(Safe, Secure, and Trustworthy AI)联合牵头人,致函两位共同主席提出五步建议。两人主张将独立国际科学小组工作组与各集群对接、起草融合国际法与欧盟《人工智能法案》等的共同参考基线、设立闭会期间常设工作流跟踪落实、由秘书处专项预算保障全球南方实质性参与,并在 2027 年纽约会议前试点跨境监管沙盒并回报结果。

  14. GovAI · 收录 · 原文 13

    Noah Feldman、Sophie-Charlotte Fischer 与 Gillian Hadfield 谈 Facebook 监督委员会的设计|GovAI 博客

    GovAI 举办了一场活动,邀请哈佛法学院教授 Noah Feldman 讲述他对 Facebook 监督委员会的观察以及一个有意义的 AI 行业评审委员会应当具备何种形态,Gillian Hadfield 与 Sophie-Charlotte Fischer 担任评议人。Hadfield 是多伦多大学 Schwartz Reisman 技术与社会研究所主任并兼任 OpenAI 高级政策顾问,Fischer 是 ETH Zurich 安全研究中心博士候选人及 GovAI 研究员,曾涉足自主武器伦理与法律、美国 AI 技术出口管制等议题。

  15. GovAI · 收录 · 原文 6

    GovAI 2018 年度报告

    GovAI 于 2018 年组建了一支由 5 名全职研究员构成的核心团队并建立研究附属网络,全年产出超过 10 项研究成果。成果涵盖《AI Governance: A Research Agenda》《The Malicious Use of AI》等报告、《When will AI exceed human performance?》等学术论文及若干手稿,其中恶意使用 AI 的报告获逾 50 家媒体报道。该组织计划继续扩张,新增 1.5 FTE 项目管理岗位,并表示希望吸纳更多人才进入 AI 治理领域。

  16. AI Verify Foundation(新加坡) · 收录 · 原文 6

    AI Verify Foundation:你的组织处于负责任 AI 旅程的哪个阶段?

    AI Verify Foundation(新加坡)发布了面向组织的负责任 AI 成熟度自查资源,帮助不同阶段的组织定位自身位置并找到对应的指引文档与技术测试工具。该资源集合涵盖从入门级基础框架到进阶实践的内容,并提供一张流程图用于评估组织当前的负责任 AI 进展,以便选择合适的下一步行动。

  17. AI Verify Foundation(新加坡) · 收录 · 原文 15

    新加坡与卢旺达联合发布全球首个《小国人工智能行动手册》

    新加坡与卢旺达在新加坡亚洲科技峰会上发布了全球首个小国人工智能行动手册,由新加坡 IMDA 与卢旺达 ICT 和创新部合作制定,并咨询了小国数字论坛成员。该手册针对资源资金不足、数据和人才获取困难等小国共性问题提出应对方案,并以持续更新的活文档形式汇集各国经验策略,配套提供 AI Verify 等实用测试工具。

  18. AI Verify Foundation(新加坡) · 收录 · 原文 27

    AI Verify Foundation 发布《Agentic AI 模型治理框架》,强调人类最终问责并新增实战案例

    AI Verify Foundation 更新《Agentic AI 模型治理框架》(Model Governance Framework for Agentic AI),指导组织负责任地部署 AI 智能体,同时强调人类始终承担最终责任。该框架系统梳理了智能体 AI 的风险及新兴最佳实践,并于 2026 年 5 月的更新中加入真实世界案例研究,说明组织如何将建议落地以满足自身需求。

  19. GovAI · 收录 · 原文 8

    GovAI 网络研讨会:前沿 AI 模型应如何监管?

    GovAI 举办了一场围绕白皮书《Frontier AI Regulation: Managing Emerging Risks to Public Safety》的网络研讨会,讨论前沿 AI 模型的监管问题。该白皮书主张 GPT-4、PaLM 2、Claude 等尖端模型可能很快具备严重危害公共安全的能力,因而需要监管,并提出了相应监管制度的构成要素及初步安全标准。Markus Anderljung、Cullen O'Keefe 主讲,Irene Solaiman 与 Jeremy Howard 作为评议人参与了坦率讨论。

  20. GovAI · 收录 · 原文 7

    GovAI 招募 Research Fellow

    GovAI 面向具备丰富研究经验的研究者招聘 Research Fellow,获聘者可自主选题并主导研究议程,同时需指导夏季与冬季研究员等初级研究者。该岗位由高级研究员或领导团队成员提供指导,工作内容包括产出学术论文、政策备忘录、报告或博客,以及组织利益相关方活动并为机构研究战略出力。研究方向涵盖风险管理、威胁建模、AI 经济学、地缘政治、前沿 AI 监管与技术治理等领域,申请时不设严格学历门槛,经验较少者可考虑为期一年的访问学者岗。