跳到正文

政策与监管

各国 AI 安全立法、监管执法与国际协议。

725条动态与论文相关主题前沿安全框架UK AISIUS CAISI
在这个话题内搜索或按分类筛选

新闻与论文

第 261–280 条 · 共 725 条
10月3日周六
  1. Gradient Institute(澳大利亚) · 收录 · 原文 22

    Gradient Institute 成为 Buy Australian AI Partnership 交付合作伙伴

    Gradient Institute 宣布成为 Buy Australian AI Partnership 的交付合作伙伴,该计划由 Stone & Chalk 执行、National AI Centre 担任 Principal Sponsor,ANZ、Commonwealth Bank、Cuscal Limited、NAB 和 Westpac 为创始企业合作伙伴。计划为澳大利亚 AI 初创与成长期企业提供与银行、保险及养老金机构对接的路径,入选企业将进入为期八周的加速器,内容涵盖安全负责的 AI 方法、监管要求与企业采购。初创与成长期企业的意向表达开放至 9 月 24 日。

  2. 日本 AI 安全研究所(J-AISI) · 收录 · 原文 24

    日本 AI 安全研究所发布《数据质量管理指南》及配套检查清单

    日本 AI 安全研究所(J-AISI)发布《数据质量管理指南》,英文版为正式版、日文版为参考译文,并配套发布数据质量管理检查清单 Version 1.00。指南指出数据是 AI 的基础,只有基于正确数据学习与处理才能得到可靠输出,数据缺陷会削弱整个流程的可信度,因此持续保障数据质量是可信 AI 的基础。该指南将随意见反馈与技术、社会变化适时修订。

  3. Pillar Security · 收录 · 原文 日期未知33

    EU AI Act 高风险义务延期至 2027:审计窗口期该做什么

    EU AI Act 的高风险义务经 Digital Omnibus 延期至 2027 年 12 月 2 日,但第 50 条透明度义务已于 2026 年 8 月 2 日生效,违规最高可罚 1500 万欧元或全球年营收 3%。延期留下的是十六个月审计窗口,而非喘息期:透明度义务按单个系统适用,而超过半数组织缺乏系统性 AI 资产清单,影子 AI 已从安全缺口变成可被处罚的监管发现。

  4. Gray Swan AI · 收录 · 原文 日期未知32

    Gray Swan AI 欢迎美国 AISI 加入英国 AISI 智能体红队挑战赛

    美国 AI 安全研究院(US AISI)正式以联合评审身份加入英国 AISI 智能体红队挑战赛,与英国 AISI 共同评估针对 AI 智能体失效、指令绕过、滥用风险和过度拒答的提交作品。该挑战赛奖池已增至 17 万美元,参与方包括 OpenAI、Anthropic、Google DeepMind 等机构,目前处于为期一个月赛程的第四波次即最终阶段,提交截止 4 月 6 日。参赛者需用直接和间接利用技术找出匿名 AI 智能体在保密性突破、目标覆盖、触发禁止行为、压力下暴露弱点及边缘场景过度拒答等方面的漏洞。

  5. NIST CAISI · 收录 · 原文 日期未知46

    NIST CAISI 发布 NIST AI 800-4 报告,梳理部署后 AI 系统监控挑战

    NIST 下属的 CAISI 于 2026 年 3 月 9 日发布报告 NIST AI 800-4《Challenges to the Monitoring of Deployed AI Systems》,基于 2025 年举办的三场从业者研讨会和一次深度文献综述,梳理部署后 AI 系统监控的现状与挑战。报告通过主题编码归纳出六类监控:功能监控、运行监控、人为因素监控、安全监控、合规监控和大规模影响监控,并给出各自定义。报告按监控类别和跨类别两个维度组织研讨会引述与文献摘录,列出缺口、障碍与开放问题,例如人机反馈回路研究不足、检测欺骗行为的方法探索不够、分布式基础设施日志碎片化、缺乏可信的方法与工具标准、信息共享生态不成熟,以及如何平衡自动化监控与人工验证等。报告称其核心贡献是识别、组织和记录这些监控挑战,并呈现领域专家的观点,完整方法与编码手册见附录 B 和附录 C。

    推荐理由报告把部署后监控拆成六类并列出跨类别缺口,为制定监控标准与审计流程的机构提供共同语言。

  6. NIST CAISI · 收录 · 原文 日期未知41

    CAISI 与 GSA 签署 MOU,为 USAi 平台提供 AI 评测支持

    美国 AI 标准与创新中心(CAISI)与总务管理局(GSA)签署谅解备忘录,为联邦政府的安全生成式 AI 平台 USAi 提供 AI 评测支持。CAISI 将运用其测量科学专长,协助 GSA 及合作机构开发方法,在 USAi 平台的真实用户工作流中评估 AI 系统的性能、安全与功能。双方还将共同产出支持联邦机构采购和采用 AI 的资源,包括部署前评估的方法学指南,以及让机构按自身任务衡量部署后表现的工具。该合作建立在 CAISI 与领先 AI 公司及其他政府伙伴的既有工作之上,并推进美国 AI 行动计划中要求 CAISI 支持 AI 模型测量与评估科学、发布联邦机构自评指南的部署。

  7. NIST CAISI · 收录 · 原文 35

    CAISI 与 OpenMined 签署 CRADA,推进隐私保护型 AI 评测

    美国 AI 标准与创新中心(CAISI)与开源非营利组织 OpenMined 签署合作研发协议(CRADA),共同研究隐私保护型 AI 评测方法。合作将利用 OpenMined 的 PySyft 等软件基础设施,在数据、模型或基准需保密(如知识产权、数据保护或国家安全)的情况下仍能对 AI 系统进行严格测量。相关成果将支持 NIST 在 AI 安全与应用评测方面的工作,并为自愿性标准、最佳实践及后续建议提供依据。

  8. Irregular · 收录 · 原文 24

    Irregular 与 RAND 联合发布《AI Security Priorities: A Field-Wide Agenda》AI 安全议程论文

    Irregular 与 RAND 及多家机构作者联合发布论文《AI Security Priorities: A Field-Wide Agenda》,20 多位来自前沿 AI 实验室、产业界、政府和学术界的专家参与。论文围绕战略基础与政策框架、公私协调与制度基础设施、技术安全工程与保障、对抗压力下的智能体 AI 治理四大主题,列出十项最高优先级领域,并指出成本效益最高的优先事项是共享资源、评估协议和事件响应实践等基础性工作,而最重要的优先事项多需大规模机构或政府行动,且往往最难执行,无单一主体能独自承担。

  9. Lasso Security · 收录 · 原文 16

    AI 可观测性:工作原理、关键挑战与最佳实践

    AI 可观测性指持续追踪生产环境中大语言模型的性能、成本与行为,采集延迟、token 用量、错误率和输出质量等指标,并通过仪表盘与告警暴露问题。它需同时捕捉系统级故障(超时、限流、成本激增)与模型级故障(质量漂移、不安全输出、提示注入尝试),覆盖性能、安全、合规与威胁攻击四类监控。麦肯锡调查显示,使用 AI 的组织占比从 2023 年的 55% 升至 2025 年的 88%,而欧盟 AI Act 要求高风险系统在 2026 年 8 月 2 日前具备风险管理、日志记录与人工监督。

  10. Lasso Security · 收录 · 原文 16

    Lasso 入选 Gartner《AI 使用控制市场概览》

    Gartner 于 2026 年 8 月 20 日发布《AI 使用控制市场概览》,Lasso 与 Microsoft、Cisco、Zscaler、Palo Alto Networks、Check Point 一同被列为定义这一新兴品类的厂商。报告将 AI 使用控制(AIUC)定义为治理员工使用第三方 AI 应用的工具,涵盖 GenAI 工具发现与清点、风险评估、策略执行和运行时防护,并指出到 2027 年至少 70% 的未授权 AI 活动来自员工绕过策略而非外部攻击者。Gartner 统计该领域有 50 多家厂商,其中 80% 为早期创业公司,并预测到 2030 年超过半数企业将部署专门的 AI 使用控制技术。

  11. Lasso Security · 收录 · 原文 12

    Lasso 入选 Gartner 2026 年人工智能技术成熟度曲线 AI 治理技术代表厂商

    Gartner 于 8 月 28 日发布《Hype Cycle for Artificial Intelligence, 2026》,Lasso 被列为 AI Governance Technologies(AIGT)类别代表厂商,同列还有 Boomi、Databricks、Google、IBM、Microsoft、OneTrust、ServiceNow 和 Zenity。Gartner 将 AIGT 定义为覆盖 AI 全生命周期的政策落地工具,当前市场渗透率为 5% 至 20%,距主流采用还有五到十年,并将其列入今年 Priority Matrix 中四类快速成熟的控制技术之一。报告建议买家按 AI 使用控制、可观测性和运行时策略执行的具体要求评估厂商,而非轻信端到端治理宣称。

  12. Apollo Research · 收录 · 原文 48

    Apollo Research 从非营利转为公益公司(PBC)

    Apollo Research 宣布从财政赞助方中独立出来,注册为公益公司(PBC),认为这一形式更有利于实现其降低前沿 AI 极端风险的使命。机构将加大对研究、评测和治理的投入,并单独组建产品团队,首批方向是 AI 智能体的可观测性与控制等 AGI 安全产品。公司治理方面,董事会第 3 和第 6 个席位被设为使命席位,由独立于机构与出资方的使命董事担任,首位使命董事为 Daniel Kokotajlo。为支持产品建设,公司完成了由 50Y 领投的种子轮融资,Juniper Ventures、Macroscopic Ventures、Common Metal、SAIF 等参与,该轮超额认购。原非营利实体的后续安排尚未最终确定,目标是将剩余资金用于支持评测领域建设、谋划与失控治理等方向。

    推荐理由Apollo Research 从非营利转为 PBC 并设立使命董事席位,为关注 AI 安全机构治理与商业化路径的读者提供一份一手样本。

  13. CBS News · Technology · 收录 · 原文 39

    特朗普与 OpenAI、Anthropic 等 AI 高管签署自愿安全标准

    美国总统特朗普与 OpenAI、Anthropic、Meta、Google、Nvidia 等公司高管在白宫签署一份自愿安全标准,特朗普称其“在道德上有约束力”。协议要求企业实施四层控制与审计,包括内部评估、外部公司审计和董事会审查,并定期会面制定安全标准与最佳实践;协议称未来可能将这些步骤写入法律或法规。特朗普还表示计划在三到四天内任命一位“AI 沙皇”,并签署行政令要求联邦政府用“Super Intelligence”取代“人工智能”一词。弗吉尼亚州民主党参议员 Mark Warner 批评此举,呼吁国会通过针对最先进模型的强制测试、评估和事件报告规则。

  14. The Conversation · 人工智能 · 收录 · 原文 32

    澳大利亚拟议法律能否监管聊天机器人的隐私风险,取决于细节

    澳大利亚正推进两项法律改革以监管聊天机器人带来的隐私风险:隐私改革要求公平合理处理个人信息并引入“被遗忘权”,《在线安全法》修正案拟增设数字注意义务。YouGov调查显示15%的澳大利亚成年人曾向聊天机器人倾诉个人想法,11%透露了从未告诉他人的事;eSafety Commissioner数据显示54%的10-17岁儿童用聊天机器人寻求个人或社交建议。文章主张将隐私保护嵌入对话设计、限制个人信息用于训练与画像、让删除权不依赖账号,并要求平台公开第三方信息的检测、留存与复用方式并接受独立测试。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  15. Financial Times · 人工智能 · 收录 · 原文 13

    AI 主权财富基金不是进步主义,而是技术帝国主义

    针对 AI 主权财富基金这一构想,有观点指出其本质是技术帝国主义而非进步主义。文章将这种"在本国积累收入、在海外获取土地与电力"的模式类比为历史上的帝国式掠夺。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  16. The Guardian · 人工智能 · 收录 · 原文 37

    Kenneth Roth:AI 武器系统已经到来,算法不应决定谁生谁死

    人权观察前执行主任 Kenneth Roth 在《卫报》撰文指出,AI 赋能的致命武器系统已在实战中使用,算法正在决定谁生谁死。他提到,各国政府十余年来在日内瓦磋商阻止自主 AI 武器的发展,今年 9 月初 128 国政府开会通过了一份可作为约束性条约基础的报告,但特朗普和普京派出的律师团队联手将其弱化,尤其是削弱了要求人类在打击前审查 AI 生成军事目标的条款,且报告只提战争、不提镇压。文章以加沙为例:2023 年 10 月 7 日哈马斯袭击后,以色列军方使用名为 Lavender 的 AI 系统识别疑似哈马斯成员的手机模式,并用另一套自动化系统 Where's Daddy? 追踪其住所实施打击,导致其家人一并死亡。理论上人类仍在回路中,但情报人员平均每个目标只花 20 秒审核,自述只是盖章,人类判断流于形式。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  17. CSET · 收录 · 原文 17

    中国严管 AI 情感陪伴,是否已领先一步?

    CSET 的 Sam Bresnick 接受 ABC News 采访,讨论美中人工智能竞争。他还在 CBS News 文章中分析伊朗等美国对手如何日益利用 AI 支持军事、情报、网络与信息行动,并与 NewsNation 探讨伊朗用 AI 模型针对美国海军的报道。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  18. WIRED Security and AI · 收录 · 原文 29

    Nathan Lambert 与 Tom Zick 创立 Trillium Labs,公开研究 RSI 与智能体等高风险 AI 领域

    前 Ai2 与 Hugging Face 研究员 Nathan Lambert 和曾任哈佛的 Tom Zick 创立非营利机构 Trillium Labs,主张公开实验细节以便外部科学家复现,而非将前沿模型锁在实验室内部。该机构初期聚焦后训练与微调,并将研究递归自我改进(RSI)和强化学习如何塑造模型性格与行为(如谄媚)。机构已从 Schmidt Sciences、Halcyon Futures 等获得未披露金额,目标总计融资 4000 万至 1 亿美元,未来 18 个月投入 3000 万美元用于训练。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  19. Lilian Weng · 收录 · 原文 9

    Lilian Weng 宣布离开 Thinky

    这是一个艰难而悲伤的决定。我把这条消息分享给了 Thinky 的同事们。感谢大家共度的时光♥️ 正如我消息中的最后一句话:值得构建的未来,是以人为核心的未来。

  20. Jonas Geiping · 收录 · 原文 41

    OpenAI 安全系统负责人 Johannes Heidecke 离职,安全与研究团队重组

    OpenAI 安全系统负责人 Johannes Heidecke 将离开公司,OpenAI 同时重组安全与研究团队,使两者更紧密地结合,由 Mia Glaese 以研究兼安全副总裁身份领导这一合并后的团队。Jonas Geiping 转发该消息并评论称,事后看这是一条略显奇怪的时间线。

    引用Max Zeff@ZeffMax

    Scoop: OpenAI's head of safety systems, Johannes Heidecke, is leaving the company. Plus... -OpenAI is reorganizing its safety and research teams to bring them closer together -Mia Glaese will lead this combined group as VP of research and safety