Google 宣布全新 AI 漏洞奖励计划
Google 在回顾两年 AI 漏洞赏金项目的基础上,宣布推出全新的 AI 漏洞奖励计划(AI Vulnerability Reward Program)。该计划面向 AI 相关漏洞,具体奖励范围与金额尚未在公告中披露。
各国 AI 安全立法、监管执法与国际协议。
在这个话题内搜索或按分类筛选Google 在回顾两年 AI 漏洞赏金项目的基础上,宣布推出全新的 AI 漏洞奖励计划(AI Vulnerability Reward Program)。该计划面向 AI 相关漏洞,具体奖励范围与金额尚未在公告中披露。
Chrome 与 Android 漏洞奖励计划(VRP)宣布调整奖励金额与奖金,改动立即生效,向当前对安全最有价值的报告类型与漏洞类别倾斜,定位为面向 AI 时代的演进。
Yoshua Bengio 提议建立一个由非营利与非政府实验室组成的多边协作网络,共同防卫民主、人权并抵御可能失控的自主 AI。该提案强调避免单点故障、防止经济政治军事权力过度集中,并要求强有力的国际性与民主授权的治理机制。相关论文已在《Journal of Democracy》发表。
Yoshua Bengio 作为主席介绍了《先进 AI 安全国际科学报告》,该报告源于 2023 年 11 月英国 Bletchley Park AI 安全峰会上一项由 30 个国家及 EU、UN 代表推动的决议,中期报告已于 2024 年 5 月 22 日首尔 AI 峰会上提交,最终版将在明年 2 月法国 AI 行动峰会上发布。报告由 70 多位专家参与撰写,其中包括各国提名的 32 位专家和 26 位高级顾问,综合科学文献并附 40 页引用,按要求不提出政策建议。
Import AI 456 期聚焦三项议题:法律与 AI 研究所提出“激进可选性”(Radical Optionality)监管理念,主张政府当下投入建设信息披露、举报人保护、政企间情报共享、灵活规则定义及评估能力等制度工具,同时避免过早过度监管,并建议加大对英国 AISI、美国 CAISI 的资金投入。该理念还回应了民主合法性、权力集中和政府滥用等质疑,且不建议大幅扩张《国防生产法案》类紧急授权。此外本期提及 RSI 与经济增长的关系,以及 Juergen Schmidhuber 提出的神经计算机(Neural Computer)。
Dean Ball 撰文回顾 2025 年 AI 进展,称 OpenAI o3 的工具调用能力是全年首个真正突破,Claude Opus 4.5 等前沿编程智能体已基本成为自主软件工程师。他描述当前工作流已两次被重塑,日常使用 Gemini 3 Deep Think、GPT-5.2 Pro、Claude Sonnet 4.5、Claude Code 等模型与智能体。他指出目前尚无吉瓦级数据中心,但到 2026 年底美国企业将掌控近六座此类设施,并认为 AI 政治化也在 2025 年成为现实。
2026 年美国各州立法会期出现大量实质性 AI 法案,覆盖责任、算法定价、透明度、陪伴型聊天机器人、儿童安全与职业许可等议题,各州在框架选择上分歧明显,可能形成真正的监管碎片化。作者指出,2025 年逾 1000 项州级 AI 法案中多数为设立研究委员会等无害内容,而今年实质性法案数量已多到无法逐一独立覆盖,因此改为按主题挑选代表性法案深入分析。
Hyperdimensional 作者 Dean Ball 提出一系列猜想讨论 AI 与儿童议题,主张不应将 AI 简单类比社交媒体——后者本质是被动消费,而生成式 AI 由用户输入驱动、更具创造性。他认为美国各州去年出台数十部 AI 儿童安全法律、今年预计超一百部,其中合理的对象层立法应要求大型 AI 公司提供年龄验证或检测、面向未成年人的内容护栏以及家长控制。他还指出,"AI 伴侣"究竟为何物尚无共识,且近几个月编程智能体的兴起给"AI 儿童安全"带来了全新含义和一批开放问题。
OpenAI 发布的 GPT-5.3-Codex 已被其团队用于监测并调试该模型的训练运行,部分研究者形容自己的工作较两个月前发生根本改变。若自动化 AI 研究带来类似推理范式的加速,新模型可能缩短到每 1-2 个月一次,最乐观情形则指向数月内出现超级智能。当前针对前沿模型的安全标准、网络安全规则以及由 AI 系统自行设计系统的可解释性与测试要求均处于空白,作者主张现阶段继续依赖实验室自律优于仓促立规。
Dean Ball 在参加德里 AI Impact Summit 后指出,这场由首尔和 Bletchley Park AI 安全峰会演变而来的全球 AI 会议上,变革性 AI、AGI 与超级智能的风险与希望被刻意回避,并非印度一方的失误,而是这类话题已不属于"体面的全球对话"。他担忧机器智能时代可能惩罚处于经济转型期的印度及全球南方国家,而非为其赋能,且当地人对此缺乏预期;他此行对印度的信心增强,但对 AI 冲击的担忧更甚于行前。
Dean W. Ball 复盘了 Anthropic 与美国国防部(现称 Department of War)围绕 Claude 在涉密场景使用条款的争端。合同最初由拜登政府谈成、2025 年 7 月由特朗普政府扩大,包含两条使用限制:不得用于对美国人的大规模监控,不得用于控制致命性自主武器。特朗普政府称改变立场并非要立即做这两件事,而是反对私营企业以合同形式对军方使用技术施加政策限制。
Dean Ball 在 Hyperdimensional 撰文回顾 2023 年在斯坦福大学散步时形成的 AI 政策基本观点,并称这些想法促成了他近期决定对美国政府对 AI 行业的某些行动划下明确界限。他自述以技术乐观主义立场看待 AI 政策,认为技术对人类历史的净效应压倒性地积极,并称 2023 年是播种之年,2026 年可能是收获之年。
OpenAI 开放一项 500 万美元资助计划的申请,用于支持独立研究生成式 AI 对青少年发展、福祉与安全的影响。该计划面向独立研究,目前正处于申请阶段。
Paul Christiano 加入 OpenAI Foundation 董事会,并进入其 Safety and Security Committee。他带来了 AI 对齐、安全与标准方面的经验。
OpenAI 的 Chris Lehane 主张,AI 能力越强,就越需要更强的安全证据、共享标准与持久的政策行动,而当前的政策窗口仍然敞开。他呼吁在窗口关闭前采取行动。
OpenAI 与美国总务管理局(GSA)合作,为符合条件的联邦、州、地方及部落政府提供 $0 许可费用、50% 使用折扣和扩展的网络防御支持。
OpenAI 发布 Australian Youth Safety Blueprint,一份由六个支柱构成、面向青少年 AI 体验安全的路线图,目标是在保护青少年的同时赋能他们。目前原文未列出六个支柱的具体内容、实施时间表或适用产品范围。
OpenAI 提出一条通往全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理来提升安全性。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。他围绕如何在 AI 发展中保持人类对系统的控制、以及各国如何开展国际协作展开论述。
OpenAI 将其 Daybreak 计划的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。