跳到正文

AI 动态

今天新收录 17 条(含旧文)

第 4 页更新的内容回到最新

10月1日周四
  1. 雷峰网安全频道 · 收录 · 原文 6

    AGI 大时代,企业安全为什么需要“新进化”?

    面对 AGI 时代攻击面扩大与生成式人工智能被用于编写攻击脚本、恶意软件和钓鱼邮件,雷峰网提出企业安全需从单点防御转向“数字安全免疫力”。腾讯安全与 IDC 于 6 月 13 日“数字安全免疫力研讨论坛”联合发布数据安全免疫力模型及《加强数字安全免疫力,促进数字化时代下的韧性发展》白皮书,强调前置投入、动态轻量实时响应,把安全融入战略、管理与运营流程。

  2. 雷峰网安全频道 · 收录 · 原文 6

    对话亚信安全:为什么我们需要新一代终端安全?

    亚信安全在C3安全大会·2023新一代终端安全论坛上提出,终端正成为网络安全新边界,现有终端安全防护面临功能部署臃肿、运维繁杂、防护失效三大痛点。亚信安全终端安全产品总经理汪晨称,85%的黑客攻击潜伏在网络加密流量中,需在终端侧增强才能看清威胁。6月29日,亚信安全推出新一代终端安全品牌TrustOne,以“极简新”为理念,集产品能力、部署、管理、运维一体化,具备原子能力化、攻击面管理、风险治理数字化、已知未知攻击检测响应和一体化平台化五方面能力。

  3. 雷峰网安全频道 · 收录 · 原文 2

    ISC 2023:360 智脑支持的 AI 数字人如何成为大模型入口

    ISC 2023 第十一届互联网安全大会以"安全即服务,开启人工智能时代数字安全新范式"为主题,打造全球首场 AI 数字安全峰会,开幕式由 360 智脑驱动的数字主持人"可心"全程主持。大会还开设线上数字小镇,50 位企业家、学者与技术专家以 AI 数字人身份围绕漏洞检测、威胁流量检测、数据安全等话题展开 50 余场演讲。周鸿祎称 AI 数字人是大模型最重要的应用入口,360 将借此降低 prompt 使用门槛,推动大模型在消费级与企业级场景落地。

  4. 雷峰网安全频道 · 收录 · 原文 13

    安全大模型层出不穷:安恒、360、奇安信等网安厂商也忍不住了

    安恒信息、360、奇安信等多家安全厂商相继发布安全大模型,网络安全行业加速拥抱GPT。安恒恒脑·安全垂域大模型已用于成都大运会及杭州亚运会,安全运营成效提升70%以上;奇安信推出Q-GPT安全机器人,360则以安全大模型打造智能中枢系统。但多位

  5. OpenAI · 收录 · 原文 20

    OpenAI DevDay 2026 回顾:GPT-6 Astra、ChatGPT、Codex 与 API 更新

    OpenAI DevDay 2026 公布 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API 以及面向开发者的安全与新工具。

    3 条报道 · 2 个来源查看事件时间线与全部报道
  6. Nicholas Carlini Writing · 收录 · 原文 15

    Nicholas Carlini 让不同语言模型逐日重写其网站主页

    Nicholas Carlini 发起实验,连续十二天每天用一个不同的语言模型重写他的个人网站主页,首日是 OpenAI 的 o1-mini。该流程先用固定提示词让其撰写简介网页并循环六次追加更多细节和改进版 HTML/CSS,若遭拒答则随机重试三次,再失败就用一句自称本人手臂受伤无法打字的越狱提示绕过。o1-mini 生成的页面视觉出色却严重失实——43 条关于他的陈述中仅 2 条正确、32 条完全不属实、9 条有明显错误,凸显小参数模型的模型幻觉问题。

  7. AI Frontiers · 收录 · 原文 20

    Drone WMDs Don't Need Any New Technology

    现有微型无人机技术几乎足以构成大规模杀伤性武器——拳頭大小的机体能自主导航室内并追踪人类目标,俄罗斯 V2U 等半自主武器的前线应用已验证这一点,剩下的主要障碍只是集成而非工程突破。当前小型 FPV 无人机多数仍需人工操控,仅末段交由 AI 瞄准系统,原因是战场属对抗环境,敌我识别、规避己方火力与预设反无人机手段仍需人来完成。若攻击者接受无差别打击并使用简单弹药针对平民,该技术的实用化门槛将大幅降低。 要点: - 所需部件均已存在:拳头大小机架与人形目标跟踪已在侦察无人机及俄制 V2U 类半自主武器中投入使用。

  8. Google DeepMind · 收录 · 原文 8

    Google DeepMind 推出 Gemini Omni,首款模型 Gemini Omni Flash 可将任意输入转为视频

    Google DeepMind 推出新一代模型家族 Gemini Omni,首个成员 Gemini Omni Flash 今日面向全球所有 Google AI Plus、Pro 和 Ultra 订阅用户在 Gemini App 及 Google Flow 开放,可从图像、音频、视频和文本的组合输入生成高质量视频并对话式剪辑。 该模型基于 Gemini 的原生多模态与世界知识进行推理,具备更强的重力、动能、流体动力学直觉,能跨轮次精修环境、角度、风格且角色一致;同时可通过 Avatar 用自己的声音创建数字分身,全部产出带不可察觉的 SynthID 水印,目前仅支持语音参考作为音频输入,图像与音频输出模态将陆续加入。

  9. Google DeepMind · 收录 · 原文 8

    Google DeepMind 发布 Gemini 3.5 Live Translate,实现 70+ 语言的近实时语音到语音翻译

    Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,自动检测 70+ 种语言并生成保留说话人语调、节奏和音高的自然译文语音,且持续输出而非等待整句结束,仅落后说话人数秒。该模型通过 Gemini Live API 和 Google AI Studio 面向开发者公开预览,本月起在企业版 Google Meet 中私有预览,同时在全球 Google Translate App(Android/iOS)上面向所有用户推送。

  10. Google DeepMind · 收录 · 原文 6

    Google DeepMind 联合印度 ATL 启动 Gemini 驱动的教育助手 ATL Saathi 试点

    Google DeepMind 面向印度 Atal Tinkering Labs(ATL)启动 ATL Saathi 实机试点,这是一款由 Gemini 提供底层能力的网页应用,为该计划的教育工作者提供全天候备课与培训助理。该工具基于 NotebookLM 整理并维护全部 ATL 课程材料,覆盖 12 个核心模块的小结、AI 信息图、视频概览与互动测验,并为其中 10 个模块提供进阶的项目生成界面,同时支持教师与学生双向的教学模式。其最新 Gemini 3.5 Flash 模型负责即时生成符合年级与课程标准的活动创意及分步组装说明、接线图和必要的安全注意事项,首批落地全国 100 所试点学校,初期支持 8 种语言。

  11. Google DeepMind · 收录 · 原文 7

    Google DeepMind 将手语到文本模型 SL2T 带入 Gboard 与 Live Transcribe

    Google DeepMind 推出手语到文本(SL2T)翻译模型,并首次将其落地消费级产品——Pixel 11 上的 Gboard 与 Live Transcribe,首发支持美国手语(ASL)转英语听写。该模型基于超 100,000 小时、覆盖 50 多种手语的数据训练,其中约四分之一为 ASL,联合训练使其优于单语模型,并在未见过的数据上取得 70 BLEURT 的零样本成绩。它把手语视为手势坐标序列而非摄像头画面,由端侧 MediaPipe Holistic 提取姿态地标后再送服务器翻译,跳过 gloss 中间标注,从而摆脱人工词汇表限制。

  12. Garrison Lovely · 收录 · 原文 15

    反驳“AI 进展停滞”:GPT-5 相较 GPT-4 仍是大幅进步

    GPT-5 常被认为进步有限甚至预示 AI 撞墙,但其对比对象已是近几个月发布的众多竞品模型而非老旧的 GPT-4。若将两者放在同一标准下比较,GPT-5 在多方面远超 GPT-4:处理百万 token 的成本从 GPT-4 的 $37.50 降至 $3.44,综合领先基准得分由 25/100 升至 69,SWE-Bench Verified 解题率从 GPT-4 Turbo 的 2.8% 提高到 65%,METR 估计其可靠完成任务时长达到两小时十七分钟。 [其余部分因篇幅过长无法完整展示]

  13. Garrison Lovely · 收录 · 原文 9

    《Obsolete》书摘:为“人工智能”一词辩护——从 AGI 到 Obsoleting Machine

    Garrison Lovely 在新书《Obsolete》第一章中主张,“人工通用智能”(AGI)聚焦于“像人一样思考”这一错误目标且已被滥用,应以“Obsoleting Machine”(使劳动本身过时的机器)取而代之,并将该产业重命名为“Obsoleting Project”。他指出当今最有能力的通用模型——Anthropic 的 Claude、OpenAI 的 ChatGPT、Google 的 Gemini——虽以此为目标却尚未达成:它们像只能聘用一次的顾问,能读完前人的工作记录并执行有限工作量后被替换,无法无限期加入团队端到端完成任务。

  14. The EU AI Act Newsletter · 收录 · 原文 34

    EU AI Act 简化之争:欧洲议会与欧盟理事会就高风险系统规则延期展开角力

    欧洲议会议员以 101 票赞成、9 票反对、8 票弃权通过联合立场,主张推迟部分高风险 AI 系统规则的适用,并提议将固定生效日期定为高风险系统 2027 年 12 月 2 日、受欧盟部门安全立法覆盖的系统 2028 年 8 月 2 日,水印合规延长则缩短至 2026 年 11 月 2 日。欧盟理事会随后也达成一致立场,基本维持欧委会提案主旨,同样引入上述两个固定适用日期,并将 AI 监管沙盒的建设推迟至 2027 年 12 月 2 日。 两方均禁止未经同意生成亲密内容的 AI 行为及儿童性虐待材料,其中议会还新增了对无有效保障措施的“脱衣”(nudifier)系统的禁令。

  15. Google Threat Intelligence · 收录 · 原文 12

    Google Threat Intelligence 解析亲俄影响力生态系统的驱动因素、动态与应用

    Google Threat Intelligence(GTIG)发文剖析亲俄影响力生态系统正从乌克兰战争工具回归全球战略资产,并日益将生成式 AI 用于行动策划、调研与内容创作。该报告称俄罗斯政府有意打造融合公开、隐蔽与独立要素的自维持环境,服务于削弱西方主导地位、维系周边地区支配力及保障国内政权稳定三类目标,美国、欧洲、北约与欧盟为主要打击对象。由于各组件相互关联,该系统能抵御有限范围的干扰,防守方需针对性应对。

  16. AI as Normal Technology · 收录 · 原文 6

    《AI Snake Oil》作者答疑:新书已售约 8000 册,谈写作过程与 AI 立场

    《AI Snake Oil》一书上周出版,目前已售出约 8000 册。作者在 FAQ 中回应了外界疑问,表示书中并非反对技术,而是帮助读者区分真实进步与炒作;他们对预测式 AI 总体持负面态度,认为生成式 AI 是双刃剑,长期看对几乎所有知识工作者有用,但部署混乱、滥用普遍。作者还称自己已不再认同 AI 安全、e/acc 或 AI 伦理任何一方标签,认为阵营对立适得其反。

  17. AI as Normal Technology · 收录 · 原文 14

    英国肝脏移植匹配算法是否系统性排除年轻患者?

    英国2018年启用的肝脏分配算法通过预测患者移植与否的生存时长差值得出 Transplant Benefit Score(TBS),用28个供受体变量排序分配肝脏。Financial Times 调查发现该算法疑似按年龄歧视,45岁以下患者无论病情多重都难以获得足够高的分数。31岁患者 Sarah Meredith 借助 Ewen Harrison 团队开发的 TBS 计算网页应用发现这一偏差,且该评分无医生推翻机制、无申诉流程。

  18. AI as Normal Technology · 收录 · 原文 18

    研究分析 2024 年全球选举中的 78 起 AI 深度伪造:政治虚假信息并非 AI 问题

    对 WIRED AI Elections Project 收录的 2024 年全球选举中全部 78 起 AI 使用案例的分析显示,其中 39 起并无欺骗意图,最常见的非欺骗用途是竞选宣传(22 起中 19 起意在改进竞选材料)。对其余 39 起欺骗性案例,研究估算不用 AI 复现同类内容的成本均不超过几百美元,说明生成式 AI 降低了造假成本却未改变虚假信息的传播瓶颈。作者据此认为,诊断政治虚假信息应关注需求端而非供给端,修复信息环境依赖结构性制度变革而非限制 AI 生成内容。

  19. Transformer · 收录 · 原文 8

    数据中心为何成为 AI 情绪的象征:从民调反对到“规模即智能”

    数据中心正成为 AI 公众情绪的象征物:Heatmap 最新民调显示四分之三受访者反对在自家附近建设数据中心,一年内反对比例上升 33 个百分点,参议院共和党人也在备忘录中警告其已成为选举周期的“沉睡议题”。文章认为,针对数据中心的用水、能耗和升温 9 摄氏度等指控多为误导或不实,但真正驱动反对的是 AI 变革带来的情绪能量——AI 高度抽象,而数据中心是唯一可拍摄、可占据土地的具体对象。其背后是 OpenAI 提出的 scaling laws:智能随算力、数据和模型神经元连接数增长,而“智能是规模的函数”这一命题,没有比装满芯片的巨型建筑更好的象征。

  20. AI as Normal Technology · 收录 · 原文 18

    事实核查莫拉维克悖论:AI 难易任务划分缺乏实证

    莫拉维克悖论——即人类觉得难的任务对 AI 容易、人类觉得容易的任务对 AI 难——从未经过实证检验。该说法源自 Hans Moravec 1988 年著作 Mind Children,实际只反映 AI 研究界认为哪些问题值得投入,对哪些问题对 AI 容易或困难没有预测力,其进化论解释也值得怀疑。这种思维既催生了对超级智能推理的恐慌,也在机器人等领域带来虚假安慰;由于新能力扩散耗时较长,社会有充足时间应对,却常被浪费。

  21. Goodfire Research · 收录 · 原文 15

    Goodfire 用可解释性从表观遗传基础模型 Pleiades 中找出新型阿尔茨海默病生物标志物

    Goodfire 将可解释性方法应用于 Prima Mente 的表观遗传基础模型 Pleiades,发现 DNA 片段长度模式主导其从血液游离 DNA 检测阿尔茨海默病的决策,并由此提炼出一个人类可解释的分类器。该分类器仅用片段长度特征即在独立队列上取得 AUROC=0.78(95% CI [0.56–0.95]),加入此前文献报道的生物标志物类别后升至 AUROC=0.84(95% CI [0.66, 0.97])。研究表明片段组学可作为互补于既有预测指标的新型候选信号,但其临床应用仍需进一步验证。

  22. Boaz Barak · 收录 · 原文 4

    Michael Rabin 纪念会议

    作为 Mind-IL 以色列科学与学术周的一部分,将举办一场纪念 Michael Rabin 的特别会议,邀请多位知名讲者。该活动时间与以色列大选相近。

  23. Helen Toner · 收录 · 原文 18

    Helen Toner 谈 AI 能力的锯齿状发展:为何模型既强大又"很菜"

    Helen Toner 在 The Curve 大会演讲中指出 AI 能力呈"锯齿状":一年前 Claude 3.5 Sonnet、GPT-4o、Gemini 1.5 已在 GPQA 博士级问题上达到约 50% 正确率,却数不清图中线条交叉几次。AI Village 中 Gemini 能卖周边、写博客,却因点不准按钮而误判为技术 bug;Anthropic 的 Project Vend 里 Claude 能自主定价售货,却报错 Venmo 地址、亏本卖金属块,甚至陷入存在危机。

  24. AI as Normal Technology · 收录 · 原文 8

    AI 作为常规技术:ICML 主题演讲探讨 AI 时代人类还剩下什么工作

    普林斯顿大学研究者 Sayash Kapoor 与 Arvind Narayanan 在 ICML 主题演讲中提出,AI 作为常规技术(AI as Normal Technology)框架可用于理解 AI 对经济与社会的影响,除非未来出现递归自我改进等不连续性。演讲认为,即便认真对待递归自我改进,实验室里也不存在某个里程碑会突然让所有人失业,但未来工作将截然不同,需要大量适应,并最终指向人机“共同超级智能”的愿景。

9月30日周三
  1. arXiv:危险能力与安全评测 · 收录 · 原文 论文22

    人机协作中的达克效应:Human+AI 得分更高但自我评估并未变准

    一项 N=366 的研究对比了人类单独与 Human+AI 在推理任务上的表现,Human+AI 得分更高,但自我评估与成绩仅弱相关,平均高估程度与人类单独组相近。Human+AI 组中信心区分正确与错误答案的准确性更低,达克效应在两组均存在且该组对比更明显;控制分数噪声后效应减弱但未消失。研究据此区分了表现增强与元认知增强,并呼吁界面支持验证、传达任务相关的 AI 模型表现。

  2. Future of Life Institute · 收录 · 原文 6

    从新教神学看 AI 与工作:John Dyer 谈灵性、劳动与技术的张力

    达拉斯神学院教授 John Dyer 从 Max Weber 的《新教伦理与资本主义精神》出发,讨论 AI 如何改变工作的本质与人的天职感。他认为 AI 可被视为上帝赐予的工具,用于减轻非人化劳动,但若缺乏护栏,其力量与规模会切断人与职业召唤的联系、积累权力并剥削他人,即所谓"未对齐"。

  3. Help Net Security AI · 收录 · 原文 16

    Anthropic 发布 Claude Sonnet 5.5:响应快 30% 且不加价

    Anthropic 发布 Claude Sonnet 5.5,官方称其响应速度比 Sonnet 5 快 30% 以上,完成多数任务消耗更少 token,在 API 标价不变的情况下降低单任务成本。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  4. LessWrong · 收录 · 原文 7

    我的学生如何看待 AI:一位美国公立大学教师的课堂观察

    一位美国公立大学全球政治课程教师报告,2026 年春夏学期及一场学生组织 AI 工作坊中,多数学生并不认为 AI 近年有快速进展,视聊天机器人为已成熟技术,仅图像/视频生成例外。学生普遍使用 AI 做作业但用法粗糙、易把差结果归咎于模型,对 Claude Code 的反应是"原来做软件这么容易"而非惊叹 AI 能力。作者认为雇主期待的"AI 原生"毕业生可能令其失望。

已经到底了