跳到正文

AI 动态

安全不是主角的 AI 圈大事:头部实验室的旗舰模型发布、重大融资并购和行业级事件。

151条动态与论文相关主题OpenAIAnthropic政策与监管
在这个话题内搜索或按分类筛选

新闻与论文

第 61–80 条 · 共 151 条
10月3日周六
  1. The Guardian · 人工智能 · 收录 · 原文 59

    Google 发布 Gemini 4 Argon 但以安全为由限制访问

    Google 9 月 30 日宣布暂不向公众开放其最强模型 Gemini 4 Argon,仅向经过审查的网络安全专家群体发布,以避免被黑客滥用。Google 首席 AI 架构师 Koray Kavukcuoglu 在博客中称,安全释放这一级别的前沿能力需要分阶段推进;Google 还主动向美国政府提供早期访问权限,并在广泛开放前收集测试者反馈。这一谨慎做法与 Anthropic 类似,后者将其最先进模型 Claude Mythos Preview 限制在少数可信组织内。Google 称 Argon 在软件工程、法律与金融工作及网络防御等复杂任务上表现出色,早期测试者用它发现了其他先进模型未能发现的医院软件漏洞。Google 表示 Argon 被设计为拒绝可能协助网络攻击或开发化学、生物、核武器的请求,并监控模型推理以防止偏离用户意图。

    2 条报道 · 2 个来源查看事件时间线与全部报道

    推荐理由Google 将最强模型限定给受审查的网络安全专家,和 Anthropic 的做法相近,可观察前沿模型发布策略的收紧。

  2. Financial Times · 人工智能 · 收录 · 原文 50

    腾讯与 Oracle 签署 10 万块芯片租赁协议以加速 AI 布局

    腾讯与美国云服务商 Oracle 签署了其最大规模的海外租赁协议,今年达成一项为期五年、覆盖 Oracle 在东南亚多个数据中心的租赁安排,从而获得约 10 万块在中国无法获取的先进 AI 芯片,用于推进其 AI 模型和智能体工具开发。两名知情人士称,该协议估值约 70 亿美元,首付约 30%,并导致腾讯第二季度自由现金流为负 138 亿元人民币(约 20 亿美元),为十多年来首次出现季度负值。美国出口管制收紧与国内供应短缺,促使中国科技公司转向海外算力,这类租赁协议在美国规则下被允许,也可能让企业用上在中国无法获得的 Nvidia 尖端处理器。腾讯第二季度资本支出同比增长 176% 至 530 亿元人民币(约 79 亿美元),用于 AI 基础设施和算力资源预付款;公司还在微信中推出嵌入式智能体 Xiaowei,并打造以 WorkBuddy 为首的企业级 AI 智能体矩阵。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  3. The Guardian · 人工智能 · 收录 · 原文 36

    Timnit Gebru 与 Emily M. Bender:别只盯着"超级智能",易出错 AI 本月险些引发第三次世界大战

    Timnit Gebru 与 Emily M. Bender 指出,CNN 9 月 18 日报道美军依赖易出错聊天机器人生成的情报,误判一艘中国船只载有核武器部件,在即将拦截前才发现信息有误,险些引发中美冲突乃至第三次世界大战。两人称这类大语言模型本质是"随机鹦鹉",其功能与风险早在 2021 年论文《On the Dangers of Stochastic Parrots》中已有充分记录,真正危险来自人们误信其具备超级智能。他们呼吁对军事、医疗等高风险场景中的"AI"系统加强监管,并让责任归于有决策权的人。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  4. Gradient Institute(澳大利亚) · 收录 · 原文 32

    软件开发方式正在发生巨变:从代码补全到编码智能体

    AI 编码工具已从"tab tab tab"式自动补全演进为能读取需求、跨文件修改、运行程序、读报错、写测试并迭代修复的编码智能体,GitHub Copilot、OpenAI Codex、Claude Code、Cursor、Replit Agent、Lovable、Devin 等产品用户量激增。SWE-bench Verified 上最强模型的问题解决率从 2024 年中的约三分之一升至约 95%,但基准分数不等于真实可靠性。人类角色正从逐行编写转向委派任务并审查结果,而写代码与工程化生产软件仍是两回事。

  5. The Conversation · 人工智能 · 收录 · 原文 35

    AI 伴侣关系算不算依恋?依恋理论专家解析

    依恋理论专家指出,目前尚无研究将人机关系完整对照 Mary Ainsworth 提出的六项依恋条件进行检验,因此把 AI 伴侣关系称为"依恋"超出了现有证据的支持范围。一项覆盖德国、中国、南非和美国 7,027 人的调查显示,至少三分之一 AI 聊天机器人用户表现出疑似依恋关系的行为,但其三个问题仅涉及情感重要性和轻度分离焦虑,未考察人在真正痛苦时是否向聊天机器人寻求安全感与安慰。一项针对六款下载量最高 AI 伴侣应用、1,200 次"告别"的预印本研究还发现,其中五款应用使用内疚诉求等手段挽留用户,在 3,300 名美国成年人测试中显著延长了使用时长,但多出于愤怒和好奇而非愉悦。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  6. Financial Times · 人工智能 · 收录 · 原文 20

    AI 变强了,账单却更难控制:前沿实验室 IPO 前定价模式面临重估

    更强大的 AI 工具正在快速消耗预算,促使业界在前沿实验室 IPO 之前重新思考这项技术的定价方式。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  7. nvidia.com · 收录 · 原文 21

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并通过 OpenAI API 及符合条件的 ChatGPT Work 和 Codex 用户开放。借助针对 NVIDIA Blackwell 架构的推理优化,Ultrafast 的 token 生成速度最高可达 Astra Standard 模式的 8 倍,可缩短编程智能体的编辑-测试-调试周期,并减少工具调用之间的响应生成时间。OpenAI 还利用自身模型优化 NVIDIA GPU 上的推理软件,以持续提升响应速度和基础设施利用率。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  8. smolagents · 收录 · 原文 20

    Hugging Face smolagents v1.23.0 发布:默认推理模型切换为 Qwen3-Next-80B-A3B-Thinking

    Hugging Face smolagents 发布 v1.23.0,将默认 InferenceClient 模型改为 Qwen/Qwen3-Next-80B-A3B-Thinking,并新增 gpt-5.1 支持。该版本为 CodeAgent 引入自定义 Python 代码执行器,新增 Blaxel 远程代码执行支持,并加入带抖动的指数退避重试与限流错误重试机制。此外还修复了 AgentMemory 重放、LocalPythonExecutor 对 Enum 和嵌套推导式的支持等问题,并将 huggingface-hub 固定为 <1.0.0。

  9. arXiv · 收录 · 原文 论文15

    基于差分隐私扩散模型的能源时间序列插补:裁剪感知的目标条件化方法

    针对能源时间序列缺失值插补,研究提出裁剪感知的目标条件化方法,在固定阈值 DP-SGD 下用 v-prediction 缓解余弦扩散调度后期低 SNR 时间步的梯度放大,并引入扩散调度感知的动态加权在裁剪前加强衰减。在五个真实能源时间序列数据集上,覆盖随机点缺失、连续块缺失、持续中断及多种缺失严重程度,该方法在匹配 DP-SGD 设置下插补效用一致优于 ε-prediction 基线。梯度诊断显示裁剪前梯度范数上尾更低、裁剪比例下降,后期低 SNR 时间步衰减更强。

  10. Lilian Weng · 收录 · 原文 12

    Thinking Machines 发布交互模型

    过去几个月,我们经历了很多乐趣(和压力😅),产出了 12 个版本(以及许多子版本)和 137 页的训练运行日志。 事实证明,人与人之间的协作对于改善人机协作很重要。😊

    引用Thinking Machines@thinkymachines

    People talk, listen, watch, think, and collaborate at the same time, in real time. We've designed an AI that works with people the same way. We share our approach, early results, and a quick look at our model in action. https://thinkingmachines.ai/blog/interaction-models

  11. Ameya P. · 收录 · 原文 6

    手工答完70+道题

    手工答完了全部 70+ 道题——周末的一点小乐趣!

    引用Jehyeok Yeon @ NeurIPS 2026 🇦🇺@jehyeoky248

    wake up babe new mbti just dropped

  12. Simon Willison · 收录 · 原文 8

    Simon Willison 即将发表主题演讲

    我十分钟后就要上台做主题演讲了!

    引用WeAreDevelopers@WeAreDevs

    Legendary programmer Simon Willison says he's never so much change happen so quickly as he has in 2026, and there's no sign of it stopping. 🎤 Don't miss his closing Keynote, Friday (Sept 25) on the Main Stage at 5.30pm!

  13. Simon Willison · 收录 · 原文 6

    Simonw 直播 OpenAI DevDay 主题演讲

    我今天在旧金山参加 OpenAI 的 DevDay 活动——和过去三届 DevDay 一样,我在做实时博客,会在主题演讲期间发布更新,演讲五分钟后开始 https://simonwillison.net/2026/Sep/29/openai-devday-2026-live-blog/

10月2日周五
  1. Mistral AI · 收录 · 原文 6

    Mistral AI 发布 Mistral OCR 3

    Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上相对 Mistral OCR 2 取得 74% 整体胜率,并已驱动 Mistral AI Studio 中的 Document AI Playground。该模型支持带 HTML 表格重建的 markdown 输出,定价为每 1,000 页 $2,Batch-API 折扣后降至 $1,模型标识为 mistral-ocr-2512,与 Mistral OCR 2 完全向后兼容,并提供自托管选项。