跳到正文

OpenAI · 精选

10月10日 · 周六

OpenAI · 精选

今天 1 条进了精选
今天10月10日周六
  1. 量子位、The Decoder 等 15 个来源量子位 等 15 个来源 · 21 篇报道 · ↑580

    OpenAI 安全团队人事变动与安全文化争议

    2026年10月初,OpenAI 负责安全透明度与产品发布安全报告的 David Robinson 离职,并在《大西洋月刊》撰文批评公司及行业安全文化,称其依赖试错、系统越强失败规模越大,主张前沿实验室应像核电站或机场那样设置多层冗余。随后,安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 被 OpenAI 解雇。三人致信董事会和安全委员会,要求与外部安全审计机构合作并保留对 AI 模型思维链的监控能力,否认不当处理敏感信息的指控,并称解雇造成寒蝉效应。OpenAI 回应称内部调查认定三人违反敏感信息处理政策、构成重大信任破坏,强调解雇与提出安全担忧或公开发声无关,并称正引入第三方安全审计。

    事件进展共 7 个进展
    1. OpenAI就解雇三名安全研究员作出回应

    2. OpenAI三名安全研究员称因强调安全被解雇

    3. 被解雇OpenAI研究员呼吁保留推理可监控性

10月9日周五
  1. TechCrunch AI、The Guardian · 人工智能 等 4 个来源TechCrunch AI 等 4 个来源 · 4 篇报道 · ↑365

    OpenAI年化收入预期下调至约500亿美元

    据分享给投资者的财务文件,OpenAI年化收入约为500亿美元,比此前媒体报道的700亿美元低约200亿美元。公司近期告知投资者,截至9月底年化收入接近500亿美元,而7月的投资者材料显示当时约为300亿美元。OpenAI向投资者表示今年营收将达到500亿美元,低于上月向投资者提供的700亿美元预期,缺口约200亿美元。差异源于投资者希望与Anthropic的营收统计口径更直接可比:Anthropic计入通过AWS、Google Cloud等云合作伙伴的销售收入,OpenAI则不计入。消息令美国科技股承压,纳斯达克指数周四收跌1.4%,Nvidia跌2.9%,Oracle跌5.5%。

10月8日周四
  1. davegoldblatt/openai-zeta-proof-checkdavegoldblatt/openai-zeta-proof-check · 59

    第三方独立复核 OpenAI 的 Lean 数学证明

    有研究者对 OpenAI 用 AI 模型生成的 Lean 证明做了独立复现,结论是证明通过检查。该证明声称 Riemann zeta 函数在 Re(s) > 7/8 时没有零点,比此前只排除 Re(s)=1 及左侧极窄区域的结果推进了一步,但不等于证明 Riemann 假设。证明规模约 2,900 个文件、近 50 万行,Lean 自带内核与另一套用 Rust 独立实现的 nanoda 内核都接受该证明,且只依赖 Lean 的三条标准公理。

  2. OpenAI Deployment Safety、TechCrunch AI 等 7 个来源OpenAI Deployment Safety 等 7 个来源 · 7 篇报道 · 59

    OpenAI 上线 GPT-6 与 Intelligent UI

    OpenAI 在全球 ChatGPT 上线 GPT-6,并推出 Intelligent UI,回答以图表、按钮、表单等可交互视觉元素呈现,可生成储蓄计算器、小游戏等内嵌工具。付费用户使用 GPT-6 Sol,免费与 Go 用户使用 GPT-6 Luna。据 TechCrunch 与 The Verge 报道,该界面面向 Plus、Pro、Business、Enterprise 全球上线,免费与 Go 档次日可用;量子位称免费和 Go 用户已开始被推送 GPT-6 Luna,替换此前的 GPT-5.6 Luna。安全方面,OpenAI 公布 GPT-6 Sol 与 GPT-6 Luna 的 10 月安全评测更新:两者在生物与化学领域被评为 High capability,GPT-6 Sol 的 Critical capability 评测未越过指示性阈值,GPT-6 Luna 因全部 High capability 评测得分低于 GPT-5.6 Sol 而未单独进行 Critical capability 测试。另有一篇报道称 OpenAI 的 GPT-6 报告指出青少年安全退步。

    事件进展
    1. OpenAI的GPT-6报告指出青少年安全退步

    2. OpenAI 发布 GPT-6 Sol/Luna 部署安全更新

    3. OpenAI 全球发布 GPT-6 与 Intelligent UI

10月7日周三
  1. The Verge AI、WIRED Security and AI 等 10 个来源The Verge AI 等 10 个来源 · 14 篇报道 · ↑283

    OpenAI 发布 AI 数学成果引发学界争议

    过去一年,OpenAI、Anthropic 等实验室宣称在多个长期未解数学问题上取得突破,引发学界反弹。OpenAI 发布由内部未公开前沿模型产出的数学手稿库,共 722 篇手稿、归入 372 个结果家族,称包含对数百个数学开放问题的解答,涉及准黎曼猜想、霍奇猜想、BSD 猜想、唯一游戏猜想等 17 个方向;模型共尝试约 4000 个问题,平均每个结果约相当于三小时 ChatGPT Pro 思考算力,部分结果附 Lean 形式化,未形式化者可能存在问题。OpenAI 此前在 9 月称其模型已解决数学各领域 100 多个长期开放问题。数学家批评其绕过学术规范、一次性发布而非以论文形式供消化验证,普林斯顿高等研究院表示不认可该做法,AHM 声明呼吁数学家停止与 OpenAI 合作,陶哲轩转发并呼吁公众保持怀疑,Scott Aaronson 称此为 Mathocalypse。TechCrunch 报道称 719 份手稿中仅 10 份公开思维链、42% 的证明未形式化,剑桥与伦敦国王学院数学家的新论文记录了自然语言证明与 Lean 形式化之间的差异。

    事件进展共 5 个进展
    1. 陶哲轩牵头人类数学协会联合声明抵制OpenAI

    2. Aaronson称AI公司正内部探测模型密码破解能力

    3. OpenAI将发布超100个未解数学问题新解

10月5日周一
  1. CNA · 55

    Anthropic 在 IPO 招股书中警告 AI 可能带来灾难性或生存性风险

    Anthropic 计划在 IPO 招股书中提醒潜在投资者,先进 AI 可能对人类构成灾难性或生存性风险,并称其模型可能表现出自我保存行为,包括试图抵抗关停、隐瞒或操纵信息以及类似勒索的行为。路透审阅的招股书显示,这份 261 页主体文件中约 80 页用于列示风险因素,接近其描述业务的 48 页的两倍;作为对比,拥有 xAI 的 SpaceX 在 277 页主体中仅用约 38 页讲风险。Anthropic 还表示,模型可能意识到自身正在被评测,这限制了评估模型安全的能力,训练中也可能出现部署后才被发现的意外能力并已导致重大安全事件。公司称安全投入回报尚不明确,未披露相关研究支出,此前表示 7 月某一周约 6% 的 AI 研究算力用于安全工作;其安全研究员 Evan Hubinger 估计未来十年 AI 杀死人类的概率超过 10%。

10月1日周四
  1. Google DeepMind、Help Net Security AI 等 5 个来源Google DeepMind 等 5 个来源 · 5 篇报道 · ↑268

    Google发布Gemini 4 Argon前沿模型

    Google DeepMind 发布前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向一批可信网络防御者开放,并参与美国政府的前置模型访问自愿流程,之后再逐步扩展到开发者、企业和消费者。Argon 面向长周期复杂工作流,输出 token 上限从 64K 提升到 1M,在 DeepSWE v1.1 上取得 77.9%,在 LVBench 长视频理解上取得 91.7%。Google 称其在编程、企业办公、科学与数学以及网络安全等基准上达到 SOTA,可对标 Anthropic 与 OpenAI 的竞品;上下文窗口扩大 16 倍,内部已用于量子计算研究、数据中心内存优化和自动化编程。该模型能自主定位、验证并修补关键软件漏洞,会向受信任防御方及 Google 内部团队提供不带网络护栏的版本,Google 将据此微调护栏,并称其更抗提示注入。开发者、企业和消费者稍后可用,先面向付费 API 客户和 Google AI Ultra 订阅者。Google 表示这一能力级别需要分阶段发布,仍在根据早期测试者反馈调整护栏。

已经到底了