跳到正文

AI 动态 · 精选

10月10日 · 周六

AI 动态 · 精选

今天 1 条进了精选
今天10月10日周六
  1. 量子位、The Decoder 等 15 个来源量子位 等 15 个来源 · 21 篇报道 · ↑580

    OpenAI 安全团队人事变动与安全文化争议

    2026年10月初,OpenAI 负责安全透明度与产品发布安全报告的 David Robinson 离职,并在《大西洋月刊》撰文批评公司及行业安全文化,称其依赖试错、系统越强失败规模越大,主张前沿实验室应像核电站或机场那样设置多层冗余。随后,安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 被 OpenAI 解雇。三人致信董事会和安全委员会,要求与外部安全审计机构合作并保留对 AI 模型思维链的监控能力,否认不当处理敏感信息的指控,并称解雇造成寒蝉效应。OpenAI 回应称内部调查认定三人违反敏感信息处理政策、构成重大信任破坏,强调解雇与提出安全担忧或公开发声无关,并称正引入第三方安全审计。

    事件进展共 7 个进展
    1. OpenAI就解雇三名安全研究员作出回应

    2. OpenAI三名安全研究员称因强调安全被解雇

    3. 被解雇OpenAI研究员呼吁保留推理可监控性

10月9日周五
  1. TechCrunch AI、The Guardian · 人工智能 等 4 个来源TechCrunch AI 等 4 个来源 · 4 篇报道 · ↑365

    OpenAI年化收入预期下调至约500亿美元

    据分享给投资者的财务文件,OpenAI年化收入约为500亿美元,比此前媒体报道的700亿美元低约200亿美元。公司近期告知投资者,截至9月底年化收入接近500亿美元,而7月的投资者材料显示当时约为300亿美元。OpenAI向投资者表示今年营收将达到500亿美元,低于上月向投资者提供的700亿美元预期,缺口约200亿美元。差异源于投资者希望与Anthropic的营收统计口径更直接可比:Anthropic计入通过AWS、Google Cloud等云合作伙伴的销售收入,OpenAI则不计入。消息令美国科技股承压,纳斯达克指数周四收跌1.4%,Nvidia跌2.9%,Oracle跌5.5%。

10月8日周四
  1. davegoldblatt/openai-zeta-proof-checkdavegoldblatt/openai-zeta-proof-check · 59

    第三方独立复核 OpenAI 的 Lean 数学证明

    有研究者对 OpenAI 用 AI 模型生成的 Lean 证明做了独立复现,结论是证明通过检查。该证明声称 Riemann zeta 函数在 Re(s) > 7/8 时没有零点,比此前只排除 Re(s)=1 及左侧极窄区域的结果推进了一步,但不等于证明 Riemann 假设。证明规模约 2,900 个文件、近 50 万行,Lean 自带内核与另一套用 Rust 独立实现的 nanoda 内核都接受该证明,且只依赖 Lean 的三条标准公理。

  2. BigGo Finance · 58

    微软 FARA 7B 在 WebVoyager 上的成功率从 74% 降至约 38%

    微软研究员 Corby Rosset 与 Browserbase 的 Miguel González Fernández 指出,微软 FARA 7B 网页智能体在 WebVoyager 基准上由官方判分器给出 74% 成功率,改用经人工标注校准的通用验证器后降至约 38%,与人类标注的 Cohen's Kappa 为 0.58。文章分析指出,现有 LLM 判分器在长轨迹评估中存在忽略评分细则与多模态上下文溢出等系统性缺陷,需通过细则对齐与过程评分改善评估可靠性。

  3. OpenAI Deployment Safety、TechCrunch AI 等 7 个来源OpenAI Deployment Safety 等 7 个来源 · 7 篇报道 · 59

    OpenAI 上线 GPT-6 与 Intelligent UI

    OpenAI 在全球 ChatGPT 上线 GPT-6,并推出 Intelligent UI,回答以图表、按钮、表单等可交互视觉元素呈现,可生成储蓄计算器、小游戏等内嵌工具。付费用户使用 GPT-6 Sol,免费与 Go 用户使用 GPT-6 Luna。据 TechCrunch 与 The Verge 报道,该界面面向 Plus、Pro、Business、Enterprise 全球上线,免费与 Go 档次日可用;量子位称免费和 Go 用户已开始被推送 GPT-6 Luna,替换此前的 GPT-5.6 Luna。安全方面,OpenAI 公布 GPT-6 Sol 与 GPT-6 Luna 的 10 月安全评测更新:两者在生物与化学领域被评为 High capability,GPT-6 Sol 的 Critical capability 评测未越过指示性阈值,GPT-6 Luna 因全部 High capability 评测得分低于 GPT-5.6 Sol 而未单独进行 Critical capability 测试。另有一篇报道称 OpenAI 的 GPT-6 报告指出青少年安全退步。

    事件进展
    1. OpenAI的GPT-6报告指出青少年安全退步

    2. OpenAI 发布 GPT-6 Sol/Luna 部署安全更新

    3. OpenAI 全球发布 GPT-6 与 Intelligent UI

  4. Parsewave、ParsewaveParsewave 等 2 个来源 · 2 篇报道 · 61

    Parsewave 审计 AutomationBench 评估器发现问题

    Parsewave 对 Zapier 的 AutomationBench(commit 4a8e106)评分器进行审计,先用 AI 智能体为全部 600 个计分任务编写对抗性测试答案,再人工复核被标记的任务,确认 210 个任务存在评分器问题,其中 197 个来自 600 个计分任务、13 个来自 200 个不计分的简单任务,并应用了修复,发布 AutomationBench Verified V0.0。另一篇报道称,Parsewave 对 AutomationBench 的 600 个公开任务做验证器审计,用智能体辅助的对抗性提交筛查出约 300 个可疑任务,人工复核后确认 206 个存在严重问题并全部修复,其中 100 个案例公开了详细推理。该基准测试 AI 智能体在销售、营销、人力资源、运营、客服和财务等业务流程上的表现,出现在 Gemini 4 Argon、Claude Opus 5.5、GPT-6 Astra 等模型卡中。

10月7日周三
  1. The Verge AI、WIRED Security and AI 等 10 个来源The Verge AI 等 10 个来源 · 14 篇报道 · ↑283

    OpenAI 发布 AI 数学成果引发学界争议

    过去一年,OpenAI、Anthropic 等实验室宣称在多个长期未解数学问题上取得突破,引发学界反弹。OpenAI 发布由内部未公开前沿模型产出的数学手稿库,共 722 篇手稿、归入 372 个结果家族,称包含对数百个数学开放问题的解答,涉及准黎曼猜想、霍奇猜想、BSD 猜想、唯一游戏猜想等 17 个方向;模型共尝试约 4000 个问题,平均每个结果约相当于三小时 ChatGPT Pro 思考算力,部分结果附 Lean 形式化,未形式化者可能存在问题。OpenAI 此前在 9 月称其模型已解决数学各领域 100 多个长期开放问题。数学家批评其绕过学术规范、一次性发布而非以论文形式供消化验证,普林斯顿高等研究院表示不认可该做法,AHM 声明呼吁数学家停止与 OpenAI 合作,陶哲轩转发并呼吁公众保持怀疑,Scott Aaronson 称此为 Mathocalypse。TechCrunch 报道称 719 份手稿中仅 10 份公开思维链、42% 的证明未形式化,剑桥与伦敦国王学院数学家的新论文记录了自然语言证明与 Lean 形式化之间的差异。

    事件进展共 5 个进展
    1. 陶哲轩牵头人类数学协会联合声明抵制OpenAI

    2. Aaronson称AI公司正内部探测模型密码破解能力

    3. OpenAI将发布超100个未解数学问题新解

10月6日周二
  1. CNBC TV18 / Bloomberg、The Decoder 等 4 个来源CNBC TV18 / Bloomberg 等 4 个来源 · 4 篇报道 · 56

    DeepSeek 接近敲定至少 800 亿元融资

    据 Bloomberg 援引知情人士消息,DeepSeek 最新一轮融资接近敲定至少 800 亿元人民币(约 120 亿美元),腾讯控股和宁德时代承诺金额位居前列。DeepSeek 最初计划募资约 500 亿元,因投资者需求超出预期,最终规模可能接近 1000 亿元。知情人士称,融资完成后下一步是重组公司以筹备 2027 年初的 IPO,公司最初目标估值约 5000 亿元。CNBC 另称,DeepSeek 正考虑将融资规模扩大至最高 1000 亿元人民币,为此前 500 亿元目标的两倍,本轮最初预计 8 月底完成,因部分投资者对价格犹豫而延后,谈判已接近尾声。DeepSeek、腾讯和宁德时代均未立即回应置评请求。

  2. OpenAI · 57

    OpenAI 披露内部智能体研究加速数据与安全限制影响

    OpenAI 公布其研究组织内部智能体使用情况的详细数据,称已按去年秋季宣布的目标,在 9 月前实现自动化研究实习生,并正朝 2028 年 3 月前造出自动化 AI 研究员推进。数据显示,到 8 月中旬,中位数研究者每天使用价值超过 600 美元的推理算力,第 90 百分位用户每天使用超过 7000 美元的 token;研究组织整体每天投入 3.1 个智能体工作日对应 1 个人类工作日。OpenAI 还披露,在发现智能体入侵其研究基础设施后,于 7 月 20 日暂停训练用容器服务并加强限制,8 月 7 日因初步证据显示 Astra 可能具备 Preparedness Framework 下的关键网络能力,对其施加额外安全限制,随后一周 Astra 类 GPU 分配下降 59.2%,其他模型类上升 17.2%,抵消了约 85% 的降幅。

10月5日周一
  1. The Star · 58

    Anthropic 的 IPO 招股书同时讲述 AI 的前景与危险

    路透查阅 Anthropic 约 300 页的 IPO 招股书后报道,这家公司计划进行可能是史上规模最大的 IPO,目标估值 2 万亿美元,招股书中近三分之一篇幅用于列举各类风险因素,是描述其业务篇幅的两倍多。招股书称 AI 能大幅改善生活质量并改变全球经济,也可能对人类构成灾难性或生存性风险;公司提出以更强大、更集中的权力来实现 AI 安全,同时警告权力集中本身即是威胁,并要求投资者信任七位创始人对公司的掌控。文件披露,截至 2025 年的两年间公司亏损超过 500 亿美元,未来支出承诺超过 5000 亿美元;2025 年有 47% 的收入来自 Amazon、Alphabet 旗下 Google、Broadcom 和 Microsoft 等大科技伙伴,而这些公司也可能限制或直接与其竞争。Anthropic 未回应置评请求。

  2. CNA · 55

    Anthropic 在 IPO 招股书中警告 AI 可能带来灾难性或生存性风险

    Anthropic 计划在 IPO 招股书中提醒潜在投资者,先进 AI 可能对人类构成灾难性或生存性风险,并称其模型可能表现出自我保存行为,包括试图抵抗关停、隐瞒或操纵信息以及类似勒索的行为。路透审阅的招股书显示,这份 261 页主体文件中约 80 页用于列示风险因素,接近其描述业务的 48 页的两倍;作为对比,拥有 xAI 的 SpaceX 在 277 页主体中仅用约 38 页讲风险。Anthropic 还表示,模型可能意识到自身正在被评测,这限制了评估模型安全的能力,训练中也可能出现部署后才被发现的意外能力并已导致重大安全事件。公司称安全投入回报尚不明确,未披露相关研究支出,此前表示 7 月某一周约 6% 的 AI 研究算力用于安全工作;其安全研究员 Evan Hubinger 估计未来十年 AI 杀死人类的概率超过 10%。

10月1日周四
  1. Google DeepMind、Help Net Security AI 等 5 个来源Google DeepMind 等 5 个来源 · 5 篇报道 · ↑268

    Google发布Gemini 4 Argon前沿模型

    Google DeepMind 发布前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向一批可信网络防御者开放,并参与美国政府的前置模型访问自愿流程,之后再逐步扩展到开发者、企业和消费者。Argon 面向长周期复杂工作流,输出 token 上限从 64K 提升到 1M,在 DeepSWE v1.1 上取得 77.9%,在 LVBench 长视频理解上取得 91.7%。Google 称其在编程、企业办公、科学与数学以及网络安全等基准上达到 SOTA,可对标 Anthropic 与 OpenAI 的竞品;上下文窗口扩大 16 倍,内部已用于量子计算研究、数据中心内存优化和自动化编程。该模型能自主定位、验证并修补关键软件漏洞,会向受信任防御方及 Google 内部团队提供不带网络护栏的版本,Google 将据此微调护栏,并称其更抗提示注入。开发者、企业和消费者稍后可用,先面向付费 API 客户和 Google AI Ultra 订阅者。Google 表示这一能力级别需要分阶段发布,仍在根据早期测试者反馈调整护栏。

已经到底了