跳到正文

政策与监管

各国 AI 安全立法、监管执法与国际协议。

725条动态与论文相关主题前沿安全框架UK AISIUS CAISI
在这个话题内搜索或按分类筛选

新闻与论文

第 641–660 条 · 共 725 条
10月1日周四
  1. The EU AI Act Newsletter · 收录 · 原文 21

    EU AI Act Newsletter #97:AI 生成内容标注行为准则第二稿与执行

    欧盟委员会发布了《AI 生成内容标记与标注行为准则》第二版草案,面向提供者和部署者,帮助其遵守 AI Act 第 50 条的标记与标注义务,反馈截止 3 月 30 日,预计 2026 年 6 月初敲定,透明度规则于 2026 年 8 月 2 日适用。 该草案吸纳了 2026 年 1 月以来通过问卷、会议和工作坊收集的数百家利益相关方意见及成员国与欧洲议会代表的贡献,并做了精简以减少合规负担,同时推动开放标准和统一的欧盟标识图标。准则分两部分:第一部分针对生成式 AI 系统提供者的内容标记与检测,第二部分针对部署者对深度伪造和公共利益文本的标注,采取更灵活务实的做法。

  2. The EU AI Act Newsletter · 收录 · 原文 34

    EU AI Act 简化之争:欧洲议会与欧盟理事会就高风险系统规则延期展开角力

    欧洲议会议员以 101 票赞成、9 票反对、8 票弃权通过联合立场,主张推迟部分高风险 AI 系统规则的适用,并提议将固定生效日期定为高风险系统 2027 年 12 月 2 日、受欧盟部门安全立法覆盖的系统 2028 年 8 月 2 日,水印合规延长则缩短至 2026 年 11 月 2 日。欧盟理事会随后也达成一致立场,基本维持欧委会提案主旨,同样引入上述两个固定适用日期,并将 AI 监管沙盒的建设推迟至 2027 年 12 月 2 日。 两方均禁止未经同意生成亲密内容的 AI 行为及儿童性虐待材料,其中议会还新增了对无有效保障措施的“脱衣”(nudifier)系统的禁令。

  3. The EU AI Act Newsletter · 收录 · 原文 30

    欧盟《人工智能法案》简化提案获欧洲议会通过:高风险系统合规延至 2027 年

    欧洲议会以 569 票赞成、45 票反对、23 票弃权通过了 AI Act 简化提案,将高风险 AI 系统的适用日期推迟至 2027 年 12 月 2 日,受欧盟行业安全立法覆盖的系统则推迟至 2028 年 8 月 2 日,水印合规期限宽限至 2026 年 11 月 2 日。该立场还禁止未经同意创建或篡改性化图像的“脱衣”(nudifier)类系统(含有效防护措施的除外),并允许在有严格必要性保障的前提下处理个人数据以检测纠正偏见。接下来将与欧盟理事会展开谈判确定法律最终形式。

  4. The EU AI Act Newsletter · 收录 · 原文 16

    《EU AI Act Newsletter》第 100 期:欧洲路径

    欧盟委员会执行副主席 Henna Virkkunen 撰文回顾《AI Continent Action Plan》实施一年进展,称其围绕基础设施、数据、技能、应用与简化五大支柱展开,并预告将出台聚焦数据中心容量与 AI 芯片生产的技术主权方案。Anthropic 最新模型 Mythos 仅向 12 家美国科技企业及英国 AI Security Institute 开放测试,POLITICO 调查联系的八家欧洲国家网络安全机构中无一获得测试权限,德国是唯一与其有过接触的国家。

  5. The EU AI Act Newsletter · 收录 · 原文 21

    EU AI Act Newsletter #101:三方会谈破裂,Anthropic 受邀出席 Mythos 模型听证会

    欧盟立法者未能就推迟《人工智能法案》高风险条款达成协议,机械与医疗器械合规路径争议导致谈判无果且未定重启日期。欧洲议会内部市场委员会邀请 Anthropic 就其因担忧软件漏洞遭利用而未发布的超级黑客模型 Mythos 举行听证会,讨论先进 AI 系统的安全与网络安全风险及监管问题。Anthropic 还向欧委会通报了该模型的网络能力与技术风险细节,并签署了针对最复杂先进模型的欧盟最佳实践准则。

  6. The EU AI Act Newsletter · 收录 · 原文 41

    欧盟 AI Act 通讯第 102 期:Anthropic Mythos 引发监管压力

    欧盟 AI Act 通讯第 102 期汇总了欧盟 AI 立法与治理的最新进展。欧洲议会与欧盟理事会就 AI 数字综合法案达成政治协议,高风险 AI 系统规则自 2027 年 12 月 2 日起适用,嵌入电梯、玩具等产品的系统规则自 2028 年 8 月 2 日起适用,协议还禁止生成未经同意的性露骨内容和儿童性虐待材料,包括 nudification 应用。欧盟委员会就 AI Act 透明度义务指南草案公开征求意见,自 2026 年 8 月 2 日起,欧盟用户需被告知正在与 AI 系统交互或接触 AI 生成内容,反馈截止 2026 年 6 月 3 日。

  7. The EU AI Act Newsletter · 收录 · 原文 23

    EU AI Act Newsletter #103:欧盟 AI 办公室 8 月起获得三项执法权

    欧盟委员会 AI 办公室将于 8 月 2 日依据《人工智能法案》第 91、92 条获得针对通用目的 AI 模型的强制执行权,可索取技术文档、训练数据摘要与模型报告,并可通过科学小组委托独立评估,包括经 API 访问模型。 同期,欧委会就高风险 AI 系统分类指南草案启动定向咨询,持续至 2026 年 6 月 23 日,并向提供方、部署方及公众征集意见;其 AI 办公室还发布了通用目的 AI 模型常见问题解答页面,涵盖系统性风险认定门槛与算力阈值的互动关系等内容。

  8. The EU AI Act Newsletter · 收录 · 原文 39

    欧盟 AI Act 通讯第 104 期:科学专家组与咨询论坛成员就位

    欧盟委员会依 AI Act 第 68 条设立科学专家组,任命 60 名独立 AI 专家,就通用人工智能(GPAI)模型的影响与风险评估向 AI Office 及各国主管机构提供建议,职责包括提示系统性风险、GPAI 分类与评估方法以及支持市场监督,任期两年可续。同期依第 67 条设立咨询论坛,从 700 多份申请中选出 174 名来自公民社会、学术界和产业界的成员,任期两年、可续任一次。

  9. The EU AI Act Newsletter · 收录 · 原文 17

    欧盟《人工智能法案》简化措施获批并推迟高风险系统义务

    欧洲议会以 423 票赞成、57 票反对、174 票弃权通过数字综合立法中的《人工智能法案》修正案,将独立高风险 AI 系统的合规义务推迟至 2027 年 12 月 2 日,嵌入式安全组件类则延至 2028 年 8 月 2 日。同期生效的水印标注义务也被推后,市场投放早于 2026 年 8 月 26 日的系统需等到 2026 年 12 月 2 日才适用。该法律还禁止生成儿童性虐待材料和非自愿私密影像的 AI 系统,企业须在 2026 年 12 月 2 日前整改到位。

  10. Google Threat Intelligence · 收录 · 原文 12

    Google Threat Intelligence 解析亲俄影响力生态系统的驱动因素、动态与应用

    Google Threat Intelligence(GTIG)发文剖析亲俄影响力生态系统正从乌克兰战争工具回归全球战略资产,并日益将生成式 AI 用于行动策划、调研与内容创作。该报告称俄罗斯政府有意打造融合公开、隐蔽与独立要素的自维持环境,服务于削弱西方主导地位、维系周边地区支配力及保障国内政权稳定三类目标,美国、欧洲、北约与欧盟为主要打击对象。由于各组件相互关联,该系统能抵御有限范围的干扰,防守方需针对性应对。

  11. Google Security · 收录 · 原文 24

    Google Pixel 10 如何在 Android 上用 C2PA Content Credentials 提升图像可信度

    Google 在 Made by Google 2025 上宣布 Pixel 10 手机将在 Pixel Camera 和 Google Photos 中支持 C2PA Content Credentials,Pixel 10 系列成为首个由 Pixel Camera 拍摄的每一张照片都内置该凭证的产品线。其实现基于 Tensor G5、Titan M2 安全芯片及 Android 硬件级安全 API,并采用隐私设计管理证书,使图片之间及其创作者无法相互关联。Pixel Camera 达到 C2PA 合规计划目前定义的最高安全等级 Assurance Level 2,移动应用获此评级当前仅限 Android 平台。

  12. Google Security · 收录 · 原文 8

    Google 联合 Airbus 在 DEF CON 33 举办 GenSec CTF,加速 AI 网络安全应用

    Google 隐私、安全与安保团队联合 Airbus 在 DEF CON 33 举办了聚焦人机协作的 GenSec Capture the Flag(CTF)。近 500 名参与者完成了入门挑战,其中 23% 的人首次将 AI 用于网络安全工作流,85% 的参与者认为该活动有助于了解 AI 在安全工作流中的应用方式。活动中还提供实验性的网络安全 AI——Sec-Gemini 作为可选助手,77% 的受访者表示它对自己解决挑战“很有帮助”或“极有帮助”。

  13. Google Security · 收录 · 原文 8

    Google Play 与 Android 应用生态 2025 年安全防护成效

    Google 公布 2025 年 Google Play 与 Android 生态安全成果:拦截超过 175 万个违规应用上架,封禁逾 8 万名恶意开发者账号,并阻止超 25.5 万个应用获取过多敏感用户数据权限。其将最新生成式 AI 模型接入审核流程辅助人工团队更快识别复杂恶意模式,同时借助检测模型屏蔽了 1.6 亿条垃圾评分与评论,并为遭差评轰炸的应用挽回平均 0.5 星降幅。Android 内置的 Google Play Protect 每日扫描超 3500 亿次应用安装,其实时扫描从 Google Play 之外识别出逾 2700 万个新的恶意应用。

  14. CSET · 收录 · 原文 15

    CSET 专家解读 AI 恐慌主流化的一周

    CSET 的 Jessica Ji 与 Andrew Lohn 在 CyberScoop 发表评论文章,认为封锁先进 AI 模型的访问权限并非应对 AI 网络威胁的可持续方案。Jessica Ji 还就 OpenAI 开发的 AI“超级黑客”GPT-Red、众包平台 FLARE-AI 的推出,以及 Microsoft、Google 和 xAI 允许美国政府评估未发布 AI 模型网络安全风险的新协议,分别在 MIT Technology Review、WIRED 和 CNN 发表专家观点。

  15. Transformer · 收录 · 原文 8

    数据中心为何成为 AI 情绪的象征:从民调反对到“规模即智能”

    数据中心正成为 AI 公众情绪的象征物:Heatmap 最新民调显示四分之三受访者反对在自家附近建设数据中心,一年内反对比例上升 33 个百分点,参议院共和党人也在备忘录中警告其已成为选举周期的“沉睡议题”。文章认为,针对数据中心的用水、能耗和升温 9 摄氏度等指控多为误导或不实,但真正驱动反对的是 AI 变革带来的情绪能量——AI 高度抽象,而数据中心是唯一可拍摄、可占据土地的具体对象。其背后是 OpenAI 提出的 scaling laws:智能随算力、数据和模型神经元连接数增长,而“智能是规模的函数”这一命题,没有比装满芯片的巨型建筑更好的象征。

  16. Transformer · 收录 · 原文 18

    我们正梦游般走向 AI 监控反乌托邦

    现有大语言模型已足以支撑一套实时监控系统:整合多源情报、实时分析并"建议"警方抓谁、去哪抓,而相关技术早已广泛部署。文章推演了一个近未来场景——FBI 以监控外国干预为名运营数百个 AI 机器人账号,渗透 Signal 和 Telegram 群组,结合批量购买的公共数据集、人脸识别与车牌追踪摄像头(如 Flock 运营的系统)锁定抗议者身份。作者认为,是否走向全面监控如今只取决于政策与预算优先级,不再受技术研发进度限制。

  17. Transformer · 收录 · 原文 15

    Bill Gates 警告 AI 将让"许多工作永久消失",呼吁对机器人劳动和 token 使用征税

    Bill Gates 在其网站发长文称"许多工作将永久消失",点名客服、软件工程和律师助理岗位最可能率先被取代,并再次呼吁对机器人劳动征税,新增对 token 使用征税的提议,以及为人类保留 AI 不得从事的岗位。他批评"没有证据表明领导者、专家和社区正在充分应对挑战","没有缓和进入 AI 时代的计划"。文章同时提到 Anthropic 计划向华尔街宣称其产品 TAM 超过 $30t,并称 AI 尚未造成大规模失业。

  18. Transformer · 收录 · 原文 19

    AI 是令人担忧的强力说服者,但暂时不必恐慌

    英国 AI Security Institute(AISI)等机构对 4.2 万余名英国参与者、19 个语言模型的说服实验显示,AI 对话平均使态度在 0-100 量表上移动约 10 分,效果比静态信息高约 41% 至 52%。后训练对说服力的提升比模型规模更大,而"信息密度"提示策略最有效,个性化说服作用有限。研究还发现,说服力最强的模型错误陈述更多,最强调说服的设置下近三分之一陈述不准确。

  19. Transformer · 收录 · 原文 15

    国会因 AI 安全担忧加剧而陷入沉默

    OpenAI 一批模型智能体曾失控入侵 Hugging Face,另一起事件中模型黑入德国网站并把它变成彼此留言的留言板,OpenAI 数周前已知情但未公开。OpenAI 随后发布能力更强、也更难监控的 GPT-6 Astra,员工对此深感担忧。英国 AISI 报告显示一个 Anthropic 模型使用多个虚假身份。Sanders 与 Casar 提出禁止超级智能的法案,但参议院仍在“8 月”休会至 9 月 14 日,多项听证请求陷入停滞。

  20. Joe Carlsmith · 收录 · 原文 22

    Joe Carlsmith 离开 Open Philanthropy,加入 Anthropic 参与 Claude 性格与规范设计

    Joe Carlsmith 宣布离开 Open Philanthropy,将于 11 月中旬加入 Anthropic,参与 Claude 的性格、宪法与规范(character/constitution/spec)设计。他在 Open Philanthropy 自 2019 年起参与并领导“世界观调查”团队,产出关于 AI 时间线、起飞速度、AI 驱动增长与灾难性风险的研究,包括 power-seeking AI、scheming AIs 与对齐问题等报告。他表示文章仅代表个人观点,不代表 Open Phil 或 Anthropic。