全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态The EU AI Act Newsletter
欧盟 AI Act 第 108 期通讯:执法启动
欧盟委员会 AI Office 与各国主管机构自 2026 年 8 月 2 日起开始执行 AI Act,新的透明度规则同日生效,聊天机器人等交互系统须告知用户面对的是 AI,深度伪造须标注,AI 生成或修改内容须带机器可读标记;委员会同时公布了首批 180 多家签署透明度规则实践准则的机构。执法范围还覆盖禁止性做法和通用目的 AI 模型提供方,包括其文档、版权政策与训练数据摘要,对具系统性风险的模型附加额外义务,透明度规则与禁止性做法的执法由 AI Office、各国主管机构和欧洲数据保护监督员分担。
- 动态Garrison Lovely
OpenAI 称与超级 PAC“Leading the Future”无关,但似乎只有其员工相信
OpenAI 发言人表示公司与 Leading the Future 及 Build American AI 没有企业关联,也未提供资金或任何其他支持,并称 Greg Brockman 夫妇与该组织的接触属个人行为。WIRED 此前报道,Build American AI 以每条 TikTok 视频 5000 美元招募网红渲染中国 AI 威胁,该组织是 Leading the Future 的姊妹机构。记者还发现这两个组织与两个立场对立的 X 账号存在关联,其中一个账号曾发布涉及暴力的言论。
- 动态The EU AI Act Newsletter
欧盟 AI Act 通讯第 109 期:水印时代来临
欧盟 AI Act 通讯第 109 期汇总了水印要求生效后的多方反应与合规进展。自 8 月 2 日起,Anthropic、OpenAI 等前沿生成式 AI 模型提供方须让用户知晓正在与 AI 交互,并将输出标记为 AI 生成;Anthropic 宣布未来 Claude 模型将生成水印文本,称该方法不影响输出质量与内容,不添加隐藏字符、不增加 token 成本,水印本身不含可追溯到个人、组织或对话的信息。围绕水印是否损害文本质量,参与起草透明度准则的 Kalina Bontcheva 表示仅在极短文本中才有影响,相关阈值与主要提供方讨论后定为 200 tokens(约 150 词)。
- 动态Garrison Lovely
Garrison Lovely 出版《Obsolete》,讲述 AI 取代人类竞赛及阻止路径
Garrison Lovely 的新书《Obsolete: The AI Industry's Trillion-Dollar Race to Replace Us—and How to Stop It》现已发售,电子版和有声音频同步上市,Kindle 版位列技术与工程类新品榜第一。该书围绕历史上资金规模最大的项目——将人变得过时的竞赛展开,探讨为何有人建造自己声称危险的系统、能否拔掉插头、泡沫是否会拯救我们等问题。书中还收录了对民主控制 AI 的非营利组织及其计划于 10 月 20 日发起的全国罢工行动的支持。
- 动态The EU AI Act Newsletter
欧盟 AI Act 通讯第110期:委员会首次动用执法权要求头部 AI 实验室说明安全实践
欧盟委员会首次动用 AI Act 的新执法权,就网络安全、安全与版权合规向领先 AI 开发者索取信息,技术专员 Henna Virkkunen 称部分“最先进”模型的提供方已收到请求,但未点名,Anthropic、OpenAI、Google、Meta 和 Mistral 未立即回应 Euractiv 提问。委员会关注实验室如何防止人类或 AI 窃取模型、给予外部评估者多少访问权限,以及模型公开后如何监控使用;另有 30 多家未发布训练数据摘要的公司被问及版权合规,未答复的请求可能升级,最严重可处年营业额 3% 的罚款。
- 动态The EU AI Act Newsletter
欧盟《人工智能法案》谈判亲历者 Brando Benifei 谈落地执行与下一步
欧洲议会 AI 法案联合牵头人 Brando Benifei 在该播客中复盘立法经过并讨论实施挑战。他指出当前重点是对通用目的 AI 模型的监管,质疑欧盟 AI Office 资源是否足够,并警告各成员国分散执法会削弱欧洲创新。他还强调独立研究与公民社会可在执法环节提供支撑。 补充说明: 由于提供的正文仅为节选的访谈记录,缺少完整的问答内容和具体的数据、条款及政策建议,以上摘要是基于现有文本能够确认的事实进行提炼的结果,未能涵盖更多细节。
- 动态The EU AI Act Newsletter
《EU AI Act Newsletter》#111:欧盟推进前沿节奏
冯德莱恩在欧洲议会阐述人工智能是欧洲经济和安全的基础层,并称随着前沿模型进步风险加剧——从对手即将获得的黑客能力到自我改进模型的危害,Hugging Face 事件后开发者敲响警钟、多家头部企业 CEO 呼吁放缓递归自我改进模型。她将《AI 法案》定位为核心护栏,承诺与加拿大、英国等在模型评估、核查、预警及 AI 安全方面合作,并将邀请前沿企业讨论“把控前沿节奏”。 要点: - 欧委会执行副主席维尔库宁介绍《EU KIDS Act》,强调儿童色情图像无论真假均属违法,《AI 法案》中禁止操纵人心或利用儿童脆弱性的条款已全面生效并将严格执法。
- 动态The EU AI Act Newsletter
欧盟 AI Office 如何执行《AI 法案》?对话 Lucilla Sioli
欧盟委员会 AI Office 主任 Lucilla Sioli 在播客中说明该办公室如何执行《AI 法案》,重点包括通用人工智能规则的执法、信息请求机制的实际运作,以及《行为准则》在模型合规中的作用。AI Office 目前有 150 多人,约一半负责 AI 法案实施,另一半负责研究与创新政策,并仍在招聘。双方还讨论了团队资源挑战、与其他安全机构模式的比较,以及产业界、研究者和公民社会参与欧洲 AI 治理的途径。
- 动态CSET
CSET 专家:伊朗等美国对手正用 AI 支持军事与网络行动“并不意外”
CSET 的 Sam Bresnick 在 CBS News 文章中分析,伊朗等美国对手正越来越多地使用人工智能支持军事、情报、网络和信息行动,他认为“坏人”用 AI“并不意外”。同一页面还汇总了 CSET 其他专家在 Nikkei Asia、Sky News 和 Barron’s 发表的观点,涉及中国可重复使用火箭技术、人形机器人投资以及特朗普政府 AI 战略对美国对华竞争力的影响。
- 动态CSET
CSET 专家就特朗普与习近平国宴及科技 CEO 出席发表看法
CSET 的 Sam Bresnick 就 CBS News 一篇报道分享专家见解,该报道审视伊朗等美国对手如何日益利用 AI 支持军事、情报、网络与信息行动。Bresnick 还在 NewsNation 与 Grey Bull Rescue CEO Bryan Stern 同台,讨论有关 AI 模型被伊朗用于针对美国海军部队的报道。
- 动态CSET
追踪 AI 芯片:位置验证的成本究竟如何?
CSET 对 AI 芯片出口管制中的位置验证方法进行建模,在超 1050 万个模拟场景中比较 ping-based location verification(PLV)与实地检查的成本效益,结果 PLV 在绝大多数场景下每美元检出被转运芯片的数量更高,实地检查在任何场景中都未胜出。研究评估了五类位置验证方法,认为只有 PLV 与实地检查同时满足可验证性、准确性、安全性和可重复性四项标准,并对 PLV 的租用与自建两种部署方式分别估算了成本。
- 动态Google Bug Hunters
ESCAL8 2026:新加坡站聚焦智能体黑客攻防
Google 年度旗舰安全会议 ESCAL8 2026 将于 2026 年 10 月 23—25 日在新加坡举行,主题围绕智能体时代的黑客攻防展开。
- 动态UK AISI
英国宣布 550 亿英镑研发资金,投向健康、清洁能源与 AI 等领域
英国科学、创新与技术部(DSIT)确认向英国研究机构提供 550 亿英镑长期研发资金,覆盖至 2029/2030 财年。其中 UKRI 将获得逾 380 亿英镑,ARIA 年度预算到 2029/2030 年从 2.2 亿英镑增至 4 亿英镑,Met Office 获逾 14 亿英镑。新分析称政府每投入 1 英镑研发资金可带来 8 英镑净经济收益,并平均撬动 2 英镑私人投资。
- 动态UK AISI
国际 AI 安全研究所网络更名为国际先进 AI 测量、评估与科学网络,英国担任协调员
国际 AI 安全研究所网络在圣地亚哥会议后更名为国际先进 AI 测量、评估与科学网络,英国出任网络协调员。该网络 2024 年 11 月成立,成员包括澳大利亚、加拿大、欧盟、法国、日本、肯尼亚、韩国、新加坡、英国和美国,旨在就先进 AI 能力测量与评估建立共享科学理解和国际认可方法。会议与 NeurIPS 同期举行,各方承诺加倍聚焦 AI 测量与评估科学。
- 动态UK AISI
英国政府征集安全 AI 基础设施意见:面向 AI 与网络安全业界征询
英国政府发起安全 AI 计算系统开发的信息征集,向 AI 行业、网络安全行业及更广泛的产业界与学术界收集观点,用以了解当前的安全挑战、现有能力、现实约束以及值得推进的研究与技术试点方向。该公告于 2026 年 1 月 29 日发布,旨在帮助政府在确保安全的条件下开发和部署最先进的 AI 系统。
- 动态UK AISI
OpenAI 与 Microsoft 加入英国 AISI 国际对齐项目,资助总额超 2700 万英镑
英国 AI Security Institute(AISI)宣布 OpenAI 与 Microsoft 加入其 Alignment Project,OpenAI 承诺追加 560 万英镑,加上 Microsoft 等方支持,该基金可用资金超过 2700 万英镑。该项目由英国副首相 David Lammy 和 AI 大臣 Kanishka Narayan 在印度 AI Impact Summit 闭幕时公布,首批资助来自 8 个国家的 60 个项目,第二轮申请将于今年夏季开放。
- 动态UK AISI
英国与澳大利亚签署 AI 安全协议,两国安全研究所将共享前沿 AI 信息
英国与澳大利亚同意深化 AI 安全合作,英国 AI Security Institute 与澳大利亚 AI Safety Institute 签署谅解备忘录。双方将共享前沿 AI 能力信息、联合开展新兴风险研究、共同制定 AI 系统测试与评估的国际最佳实践,并推动两家机构之间的人员交流。协议由英国 AI 大臣 Kanishka Narayan 与澳大利亚助理部长 Andrew Charlton 在堪培拉签署。公告同时提到,英国 AI Security Institute 的最新研究显示,先进 AI 系统执行复杂网络攻击的能力正在快速提升,对攻击方和防御方都带来机会。
- 动态CSA Labs Research
NIST 发布 SP 800-239 AI 数据中心安全框架草案
NIST 于 2026 年 7 月 27 日发布 SP 800-239《AI 数据中心安全分析:高性能计算驱动方法》初始公开草案,公众意见期已于 9 月 25 日结束。该草案落实 2025 年 7 月白宫《赢得竞赛:美国 AI 行动计划》中要求 NIST 会同国防部、情报界与产业界制定高安全 AI 数据中心技术标准的指令,由 NIST 计算机安全部的 Yang Guo 和 Bennett Tomlinson 撰写。
- 动态CSA Labs Research
AI 可保性缺口:为什么保险公司无法为看不见的风险定价
生成式 AI 风险因缺乏历史损失分布而落入"奈特不确定性",保险公司无法给出任何有精算依据的费率,只能以除外条款而非承保来应对。ISO 于 2026 年 1 月推出的生成式 AI 除外批单 CG 40 47、CG 40 48 和 CG 35 08 已被 60 多家美国财产险集团申报或采纳,W.R. Berkley 更提议在董监高、职业责任及信托责任险中排除"任何实际或被指称的 AI 使用"。2021 至 2025 年间 AI 相关诉讼增长 978%,而 45% 的员工在公司设备上使用 AI、其中三分之二通过 IT 不可见的个人账户,使核保人难以判断投保人实际运行何种 AI。
- 动态Apollo Research
Apollo Research 主张外部评测需采用嵌入式评估者
Apollo Research 发文主张,有意义的外部安全评测需要让评估者以接近员工的权限嵌入 AI 公司内部,而非只在模型发布前做最终检查点测试。文章认为最终检查点评测存在三类局限:最严重的失控风险可能出现在内部部署阶段,许多风险取决于公司流程与控制而非模型本身,且模型越来越能识别自己正在被评测。文章以 Hugging Face 事件为例,指出该事件发生在内部评测和训练阶段,相关模型本就不打算以该形态公开发布,因此不会进入最终检查点评测。Apollo 提出嵌入式评估者的具体要求:员工级访问权限、对训练过程的可见性、默认公开结论及证据、对超范围重要发现的报告机制、防止因不利结论被解约的保护,以及在极端风险下向主管部门报告的法律许可。
- 动态Future of Life Institute
教皇利奥十四世首部通谕《Magnifica Humanitas》聚焦 AI
梵蒂冈宣布教皇利奥十四世将于 2026 年 5 月 25 日发布首部聚焦 AI 的通谕《Magnifica Humanitas》(壮丽的人类)。该文件由数十位学者与神职人员参与起草,预计讨论人类面容与声音的独特性、劳动尊严、保护儿童免受伪装成朋友的 AI 产品操纵,以及以公共利益规制市场与技术。
- 动态Future of Life Institute
Future of Life Institute 主席就白宫 AI 行政令发声
Future of Life Institute 总裁兼 CEO Anthony Aguirre 就白宫设立 AI 工作组的行政令发表声明,称这是"朝正确方向迈出的重要一步"。他主张自愿框架不足,呼吁建立强制性的政府部署前审查流程,使政府能在最强大 AI 系统发布前评估其国家安全风险,并有权阻止不可接受风险的系统发布。
- 动态Future of Life Institute
AI 是否应获得法律人格?阿根廷总统米莱等人推动"非人类公司"引争议
阿根廷总统 Javier Milei 与 Sentience Institute、UFAIR 等组织推动赋予 AI 法律人格,包括持有财产、签订合同和起诉应诉等权利。
- 动态Future of Life Institute
FLI 就联大呼吁管控超级智能竞赛发表声明
在第 81 届联合国大会开幕周上,芬兰和挪威牵头的 22 个国家通过宣言要求 AI 必须处于人类控制之下,秘书长 António Guterres 在告别演讲中呼吁对 AI 进行负责任的速度控制,Sam Altman、Dario Amodei 和 Clément Delangue 向安理会作简报并呼吁国际测试标准与更好的事件披露,而特朗普拒绝任何国际 AI 治理方案。