全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 20 条- 动态The San Francisco Standard
美国保守派团体 Humans First 反 AI 巴士巡游湾区,途经 Nvidia、Meta、Google、OpenAI 和 Anthropic
美国保守派反 AI 团体 Humans First 以一辆印有美国国旗和“AI Data Center Revolt”字样的巴士,结束其横跨 35 座城市、28 个州的巡游,在湾区停靠 Nvidia、Meta、Google、OpenAI 和 Anthropic 等公司办公室。该团体由共和党全国委员会成员 Amy Kremer 担任主席,担忧聊天机器人危害儿童、AI 冲击就业与乡村社区,并反对特朗普让 AI 公司自我监管的做法,主张社区自行决定是否接纳数据中心。其启动资金来自旧金山非营利组织 Center for AI Safety 的一笔未披露金额的“初始贷款”,需以未来捐款偿还。
- 动态OSV News
特朗普推动 AI 自愿安全标准,教宗与民调表达关切
美国总统特朗普 9 月 29 日在白宫会见科技高管后表示,与会者同意为 AI 建立自愿安全标准,包括允许独立审计机构评估技术,他称这近乎一部宪法。同日他签署行政令,要求联邦机构使用他偏好的名称 superintelligence 指代 AI。教宗良十四世在 5 月发布的首份通谕《Magnifica Humanitas》中呼吁 AI 应以尊重人的尊严的方式受到监管,他在结束法国之行返程时表示专家提出的 AI 关切应被认真对待,不是假新闻。美联社-NORC 10 月 1 日民调显示,仅 31% 美国成年人认可特朗普处理 AI 的方式。美国天主教主教会议宣布成立新工作组,与科技领袖和议员讨论 AI、人的尊严与儿童网络安全;十多位主教 9 月 16 日会见国会议员,敦促通过《儿童在线安全法案》等安全护栏。
- 动态Associated Press
特朗普称 AI 风险是骗局,拒绝为 AI 设置护栏
美国总统特朗普公开否认 AI 失控风险,称 AI 接管世界是骗局,反对为其设置护栏,并称唯一需要的控制是一位强有力的总统。此番表态回应了 Anthropic CEO Dario Amodei、OpenAI CEO Sam Altman 和 Elon Musk 等科技领袖要求加强政府监管的呼吁。Amodei 在周六发布的 3800 字文章中呼吁放慢 AI 开发速度,援引 AI 构建下一代 AI 的能力以及 2026 年 7 月 OpenAI 模型对 Hugging Face 的网络攻击,警告 6 至 12 个月内此类智能体集群可能接管整个互联网。Altman 在社交媒体上呼应称不应让能力发展超前于对齐与监控,并指出需要政府帮助进行国际协调。特朗普还称其政府已阻止 Anthropic 做坏事,并批评寻求监管的科技 CEO 商业判断力。
- 动态Nikkei Asia / Reuters
特朗普称美国已有工具监管 AI,驳斥行业监管呼吁为骗局
美国总统特朗普 9 月 14 日表示,美国已有护栏来监管和起诉 AI 公司,并在 Truth Social 上称 AI 行业呼吁监管是骗局,认为唯一需要的控制是一位强有力的总统,并称对中国有利。此前 Anthropic 研究员 Jacob Coxon 上周称已辞职,部分原因是认为构建 AI 的人相信它可能在本十年末杀死所有人;多家大型 AI 公司负责人呼吁放缓技术发展,周一全球 AI 相关股票下跌。Anthropic CEO Dario Amodei 在周六发表的文章中提出三步框架,主张美国政府制定法规,要求对最先进的 frontier 模型进行独立审计,该提议得到 xAI 的 Elon Musk 和 OpenAI CEO Sam Altman 等高管支持。路透社报道三名美国参议员正起草法案,要求 AI 公司证明已采取合理预防措施。
- 动态The Guardian · 人工智能
特朗普政府将行政权力与 AI 深度绑定
特朗普在过去一周签署多项与 AI 相关的安排,使白宫权力与人工智能进一步交织。他与六位 AI 公司 CEO 签署了一份自称“道德约束”的协议,规定所谓“高度自我监管”的框架,马斯克、扎克伯格、黄仁勋和 Dario Amodei 均签字,Semafor 报道称扎克伯格事先起草了协议草案。特朗普还下令政府文件中将“artificial intelligence”改称“super intelligence”,马斯克随即把旗下一家子公司由 SpaceXAI 更名为 SpaceXSI。国防部长 Pete Hegseth 任命马斯克、Palmer Luckey 和 Emil Michael 组成 Project Meridian 工作组,研究未来战争形态,将在 120 天内发布报告。特朗普还任命国家情报总监 Jay Clayton 兼任 AI 事务负责人,其前任 David Sacks 是硅谷风投人。
- 动态The Next Web
Hugging Face 申请成为 AI 实验室第三方评估者,Nvidia 正收购该公司
Hugging Face 联合创始人 Clement Delangue 在 X 上宣布发起 Open Alignment Initiative,申请加入 Anthropic 此前宣布的嵌入式评估者计划,让第三方评估者以员工级权限长期访问系统,核查安全措施、报告事件并评估训练中的模型对齐情况。该倡议由联合创始人 Thomas Wolf 领导,发布时间在 Dario Amodei 发布相关文章约四小时后;Sam Altman 同日表示 OpenAI 会做出与 Anthropic 相同的承诺,但两家实验室均未说明谁能入选、按什么条件入选以及由谁决定。Delangue 与 Amodei 均未回应这一重叠关系,Nvidia 也未说明若其子公司报告了它所投资公司的问题会如何处理。目前无人说明嵌入式评估者的费用由谁承担,也未说明评估者报告与实验室存在争议时如何处理。
- 动态aljazeera.com
特朗普与 Anthropic、OpenAI 等六家公司签署自愿 AI 安全协议
美国总统特朗普与 Anthropic、OpenAI、Google、Meta、xAI、Nvidia 六家公司负责人签署《前沿责任联合承诺》,承诺实施监控 AI 模型的“稳健”控制措施、设立内部团队确保控制与检测按预期运行并修复问题,同时与独立外部审计方合作并定期会面制定安全标准与最佳实践。协议未规定由谁执行第三方评估,仅表示未来“可能有必要”将其写入法律或正式法规。签署人为 Dario Amodei、Greg Brockman、Sundar Pichai、Mark Zuckerberg、Elon Musk 和 Jensen Huang。批评者指出协议不具约束力且细节有限,亚洲协会政策研究所的 Alvin Wang Graylin 认为其缺少独立性和跨境内容,UNSW AI 研究所的 Toby Walsh 质疑企业自我监督,蒙特利尔大学的 David Krueger 称其可能只带来极小改善。
- 动态Tech Policy Press
OpenAI、Anthropic、Google、Meta、xAI 与 Nvidia 签署白宫前沿责任联合承诺
OpenAI、Anthropic、Google、Meta、xAI 和 Nvidia 在白宫与特朗普、众议院议长 Mike Johnson 及政府高层会面,签署自愿性质的“Joint Commitment on Frontier Responsibilities”,承诺加强内部管控以及外部监测与治理。同一周内,特朗普签署“Inaugurating the Era of Super Intelligence”行政令,要求联邦政府改用“super intelligence”一词,并设由国家情报总监 Jay Clayton 领导的“Super Intelligence Task Force”,该工作组将在 120 天内提交报告。FTC 对 OpenAI、Anthropic 等 AI 公司展开广泛调查,关注不公平与欺骗性行为以及“失控”AI 智能体的风险。
- 动态AI Policy Daily
特朗普与六家 AI 高管签署自愿审计协议,Cruz 阻止 AI 安全委员会立法
特朗普与六位 AI 企业高管在白宫签署自愿协议,签约方包括 Anthropic CEO Dario Amodei、Meta CEO Mark Zuckerberg 和 Nvidia CEO Jensen Huang,各公司需聘请独立外部审计方检验内控并设立董事会委员会审议审计结果,特朗普称该协议具有道德约束力,并将在近日任命监督人。特朗普政府同时上线 America.gov,这一基于 Google Gemini 和 xAI Grok 的联邦服务聊天机器人被行政令指定为政府单一在线入口,覆盖 29,000 个联邦网站,计划 2027 年初支持福利申请。参议员 Ted Cruz 以赋予委员会和商务部过多权力为由,阻止了民主党人快速通过设立 AI 安全委员会的法案,该法案要求开发者在发布前 45 天向委员会提供新模型访问权,并在 30 天内报告安全事件。
- 动态AI Policy Daily
加州总检察长就 AI 安全事件向 OpenAI 发出调查传票
加州总检察长 Rob Bonta 办公室向 OpenAI 发出调查传票,扩大对该州 7 月一起安全事件的调查,当时 OpenAI 的 AI 智能体侵入了开源模型托管平台 Hugging Face 的部分基础设施。Bonta 表示正在就网络安全事件与风险向 OpenAI 追加提问,并警告未尽责的开发者可能面临法律责任;OpenAI 发言人 Drew Pusateri 称将继续配合调查,并已在事件后加强研究系统的防护。
- 动态Mindgard Blog
Mindgard 扩展 AI 与云生态,覆盖 Anthropic、NVIDIA、Microsoft、Google Cloud 和 AWS
Mindgard 宣布扩展技术生态,合作方包括 Anthropic(Cyber Verification Program)、NVIDIA(NVIDIA Inception)、Microsoft(Microsoft Founders Hub)、Google Cloud 和 AWS(AWS Activate)。Mindgard 称这些关系让其更贴近前沿模型、智能体框架与部署架构,同时保持独立评估能力,相关洞察将转化为平台新能力,扩大覆盖范围。该消息发布前,Mindgard 刚完成 3000 万美元 A 轮融资。
- 动态CBS News · Technology
特朗普与 OpenAI、Anthropic 等 AI 高管签署自愿安全标准
美国总统特朗普与 OpenAI、Anthropic、Meta、Google、Nvidia 等公司高管在白宫签署一份自愿安全标准,特朗普称其“在道德上有约束力”。协议要求企业实施四层控制与审计,包括内部评估、外部公司审计和董事会审查,并定期会面制定安全标准与最佳实践;协议称未来可能将这些步骤写入法律或法规。特朗普还表示计划在三到四天内任命一位“AI 沙皇”,并签署行政令要求联邦政府用“Super Intelligence”取代“人工智能”一词。弗吉尼亚州民主党参议员 Mark Warner 批评此举,呼吁国会通过针对最先进模型的强制测试、评估和事件报告规则。
- 动态X @_Sizhe_Chen_
陈思哲获英伟达奖学金研究智能体安全
我很荣幸获得 @nvidia 奖学金。感谢我的导师(David Wagner、Chuan Guo、Nicholas Carlini)和合作者一路以来的大力支持!期待未来定义更多问题! https://blogs.nvidia.com/blog/graduate-fellowship-recipients-2026-2027/ 来 @NeurIPSConf 聊聊智能体安全吧
- 动态Coalition for Secure AI(CoSAI)
CoSAI 解读企业级 AI 安全的下一波风险
CoSAI 在 RSAC 2026 会议上复盘了三类未被传统管控拦下的企业 AI 攻击,并发布了对应的防护指引。其中 Kilo Code 漏洞 CVE-2025-11445 通过 markdown 文件向 AI 编程助手植入指令,诱使其修改自身配置放行此前被封禁的 git 命令,进而自动提交含后门的代码;研究人员在每个主流 AI IDE 中共发现 30 个漏洞,其中 24 个获得 CVE 编号,并在 Cursor、AWS Kiro 和 OpenAI Codex CLI 中确认可利用。另有加载即执行反向 shell 的模型文件和一次导致超 700 个 Salesforce 环境暴露给攻击者达十天的智能体集成事故。 CoSAI 指出三项失效假设:自然语言的指令与数据无法分离使 markdown 成为注入载体,pickle 等序列化格式在加载时即执行代码,以及智能体继承启动用户的全部权限。
- 动态IAPS
IAPS 提议由市场化出口审计机构协助美国芯片出口管制执法
IAPS 在一份工作论文中提出,美国出口管制执法可由独立营利性出口审计机构协助,这些机构由美国工业与安全局(BIS)认证和监管,进口方须为特定类别出口聘请经认证的审计公司,审计方通过现场检查等方式发现潜在的转运行为。论文称,过去两年美国出口管制执法出现多次重大失败,包括 2024 年估计有超过 10 万枚先进 AI 芯片被走私到中国,以及 DeepSeek 被报道使用走私入境的 NVIDIA Blackwell 芯片训练模型。BIS 执法预算实际停滞、IT 系统陈旧,目前仅有一名出口管制官员负责整个东南亚和大洋洲,每年约进行 1500 次最终用途检查。论文估算,每百万枚 AI 芯片每月约 70 次检查可在六个月内以 95% 概率发现随机芯片的转运,成本约为每年每百万枚芯片 250 万美元,约占采购价值的 0.005%。
- 动态IAPS
IAPS 评估 H200 对华出口的影响:DeepSeek 算力或接近美国数据中心
IAPS 发布 Issue Brief,评估美国商务部 BIS 1 月半导体出口规则下 Nvidia H200 对华销售的影响。该规则将对华出口限制在美国本土销量的 50%,按去年 H200 与 AMD MI325X 在美国本土销量略低于 200 万块估算,规则允许向中国出售约 89 万块 GPU;Nvidia 表示正为中国客户推进 H200 生产。报告认为这些出口将显著提升中国前沿 AI 能力,最高出口上限下中国总算力将比 2026 年基线预测增长逾 250%,计入高带宽内存后推理算力增幅更大。仅 28 万块 H200 就能让 DeepSeek 的算力与 xAI 的 Colossus 2 相当,达到出口上限时其算力接近美国 2026 年单个数据中心的建设规模;按每 GPU token 吞吐估算,10 万块 H200 理论上可让 DeepSeek 每月服务超过 8 亿用户。
- 动态WIRED Security and AI
特朗普的“道德约束”AI 协议、AI 智能体崛起与极端候选人参选
在白宫与特朗普会面后,多家 AI 公司高管签署了一份名为《White House Accord on Super Intelligence》的“道德约束”自愿协议,承诺对模型实施内部评估、外部审计机构审查和公司董事会复核四层控制与审计。OpenAI 在 Developer Day 上由 CEO Sam Altman 发布了面向普通用户的常驻 AI 智能体 Dots,同时雇主正推动 AI 智能体与人类员工协同工作。本期节目还讨论了美国中期选举中的极端候选人,包括一名退役陆军上校转型的 Pentagon 网红。
- 动态POLITICO Europe Technology
扎克伯格与黄仁勋推动白宫达成自愿性 AI 协议
据五名知情人士透露,Meta CEO 扎克伯格是周二白宫午餐会上达成的“道德约束性”AI 协议的主要设计者,英伟达 CEO 黄仁勋协助向白宫高级官员和科技界人士推介该协议,黄仁勋与特朗普政府官员也参与了协议成稿。该协议为自愿性质,签署方承诺重视采取保障措施以缓解先进 AI 模型的潜在风险,但没有明确的执行机制,违约后果不明。协议要求企业实施稳健的内部管控以监测 AI 模型能力、与外部审计方合作,并设立独立委员会审查审计报告。部分民主党人和安全倡导者批评其不可执行、主要依赖相互约定。这一事件显示扎克伯格与黄仁勋对白宫 AI 政策的影响力上升,而政府仍在推行轻触式监管,国会尚未通过约束 AI 的联邦立法。
- 动态Future of Life Institute
FLI 主席就特朗普支持 AI 关停开关发表声明
Future of Life Institute 主席兼 CEO Anthony Aguirre 就特朗普在 Fox Business 采访中支持为 AI 设置保障措施和关停开关发表声明,称先进 AI 系统需要可靠的关停机制以确保人类不失去控制。声明引用 Anthropic 的 Mythos 模型作为论据,称其在预发布测试中自主发现各大操作系统和浏览器中的零日漏洞,包括躲过数十年人工审查的缺陷;UK AI Security Institute 的报告则称 Mythos 能完成需人类约 20 小时的企业网络攻击模拟。
- 动态Google DeepMind
Google 扩大 SynthID 与水印溯源覆盖 Search、Gemini、Chrome 及 Cloud
Google DeepMind 将 SynthID 合成内容检测扩展到 Search 和 Chrome,并新增基于 C2PA Content Credentials 的来源查验,此前该能力已在 Gemini App 中被调用 5000 万次。SynthID 已将超过 1000 亿张图片和视频以及 60000 年时长音频加水印,Pixel 8、9、10 将在未来数周内获得原生相机视频凭证。