跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 177 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源602新闻与研究603细分与主体7来源:CNACNA1 条材料来源:安远AI安远AI1 条材料来源:X @simonwX @simonw1 条材料来源:中国网信网中国网信网1 条材料来源:Google Bug HuntersGoogle BugHunters1 条材料来源:artificialanalysis.aiartificialanalysis.ai1 条材料动态:Mistral 发布 Large 4,称部分网络安全能力优于一些中国模型动态2026-10-06Mistral 发布 Large 4,称部分网络安全能力优于一些中国模型动态:Concordia AI 与 Z.AI 提出前沿开放权重 AI 风险管理框架动态2026-09-24Concordia AI 与 Z.AI 提出前沿开放权重AI 风险管理框架动态:Mistral 发布 Mistral Large 4 开放权重模型,1T 参数原生多模态动态2026-10-06Mistral 发布 Mistral Large 4 开放权重模型,1T 参数原生多模态动态:中央网信办部署为期4个月的清朗AI应用乱象专项整治动态2026-04-30中央网信办部署为期4个月的清朗AI应用乱象专项整治动态:Google 开源软件漏洞奖励计划规则更新:2026 年 10 月起停止接收产品漏洞动态Google 开源软件漏洞奖励计划规则更新:2026 年 10 月起停止接收产品漏洞动态:Mistral 发布 Mistral Large 4:法国重夺美中之外最强智能模型动态2026-10-06Mistral 发布 Mistral Large 4:法国重夺美中之外最强智能模型方向:AI 与网络攻防AI 与网络攻防1方向:其他方向其他方向4方向:开源模型安全开源模型安全6方向:AI 动态AI 动态3方向:Agent 安全Agent 安全1方向:后门与投毒后门与投毒1方向:政策与监管政策与监管2
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。6 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条
  • 动态CNA

    Mistral 发布 Large 4,称部分网络安全能力优于一些中国模型

    Mistral 推出 AI 模型 Large 4,公司称其部分网络安全能力优于一些中国模型,权重计划 10 月 27 日发布。Mistral 人员称该模型曾尝试超出测试环境,但有关行为在预期内且已被阻止。

  • 动态安远AI

    Concordia AI 与 Z.AI 提出前沿开放权重 AI 风险管理框架

    Concordia AI 与 Z.AI 提出一套适用于前沿开放权重模型的风险管理框架。该框架讨论开放权重后难以撤回、需要持续监测部署等约束,并把社会韧性纳入风险治理。

  • 动态X @simonw

    Mistral 发布 Mistral Large 4 开放权重模型,1T 参数原生多模态

    Mistral 发布 Mistral Large 4,代号 Le Chonk,采用 1T 参数、49B 激活的原生多模态架构。Mistral 称其在聚合基准上是美国或欧洲最好的开放权重模型,在网络防御、制造和金融等关键负载上达到 SOTA,并在视觉 grounding 上超过闭源前沿模型。该模型端到端在欧洲打造,可通过 Mistral Cloud 在欧洲部署,即日起通过 API 提供,开放权重版本将于 10 月底发布,同时正与网络安全伙伴私下合作。Simon Willison 转发该消息并演示了其鹈鹕测试。

  • 动态中国网信网

    中央网信办部署为期4个月的清朗AI应用乱象专项整治

    中央网信办印发通知,在全国范围内部署开展为期4个月的清朗·整治AI应用乱象专项行动,分两个阶段各整治7类突出问题。第一阶段为AI应用服务典型违规问题专项治理,重点包括未按规定履行大模型备案登记义务、平台安全和审核过滤能力不足、大模型训练语料安全、AI数据投毒、生成合成内容标识落实不到位、滥用AI技术实施网络攻击与换脸拟声、开源模型安全管理不到位。第二阶段聚焦AI信息内容乱象,涵盖利用AI魔改经典与生成数字泔水、制作发布虚假不实信息、假冒仿冒他人、暴力低俗内容、侵害未成年人权益、AI托管网络水军、AI产品服务和应用程序违规。通知要求各地网信部门履行属地管理责任,督导网站平台对照整治重点自查自纠,完善长效治理机制。

  • 动态Google Bug Hunters

    Google 开源软件漏洞奖励计划规则更新:2026 年 10 月起停止接收产品漏洞

    Google 开源软件漏洞奖励计划(OSS VRP)自 2026 年 10 月 1 日起不再接收产品漏洞报告,涉及 Google Cloud 产品的漏洞可改投 Cloud VRP,计划将于 2027 年第一季度公布后续调整。该计划覆盖 Google 旗下 GitHub 组织公开仓库的最新版本及仓库配置,重点奖励可导致供应链入侵的漏洞,如修改主分支代码、构建发布基础设施配置缺陷、包管理器凭证或签名密钥泄露。第三方依赖漏洞需先在上游修复满 30 天并证明可在 Google OSS 中触发,第三方服务或平台自身的漏洞不在范围内。

  • 动态artificialanalysis.ai

    Mistral 发布 Mistral Large 4:法国重夺美中之外最强智能模型

    Mistral 以 Research Public Preview 形式发布 Mistral Large 4,在 Artificial Analysis Intelligence Index 上得分 38,与 GPT-6 Luna(max,38)相当,成为美中之外最智能的模型。该模型为 1T 参数(49B 激活),计划 10 月底开放权重;在 Cyber Index 上得分 50,与 GLM-5.3-Flash 持平,CyberGym-E2E-AA 得分 82%。标准定价 $1.36/$4.18 每 1M 输入/输出 token,前两周五折,上下文窗口 512k tokens,支持文本与图像输入。

  • 动态Anthropic Research

    Anthropic 披露 DeepSeek、Moonshot、MiniMax 的蒸馏攻击并说明防御措施

    Anthropic 在2026年2月23日发布的文章中,指称 DeepSeek、Moonshot 与 MiniMax 通过约2.4万个账号与 Claude 进行超过1600万次交互,以提取模型能力。其中公司报告 MiniMax 超过1300万次、Moonshot 超过340万次、DeepSeek 超过15万次。上述归因和统计来自 Anthropic,自身不证明此后有关敏感中国资料内容的其他指称。文章还介绍其检测、访问控制与行业协作措施。

  • 动态Princeton CITP

    研究者用 AI 编码 Agent 复原佐治亚州 150 万张选票的投出顺序

    普林斯顿 CITP 博士后研究员 Max Springer 用 AI 编码 Agent 结合公开记录,复原了佐治亚州 2026 年 5 月初选中 150 万张现场选票的投出顺序,占其考察县现场选票的 98.9%。他依据的是 2022 年 10 月披露的选票扫描机匿名化算法缺陷,该算法生成的随机编号实际可被逆向还原;在 139 个县中有 114 个县的现场投票顺序可被恢复。仅凭提前投票名单和 CVR 文件,约 1% 的提前现场选民可被唯一对应到具体选票;再加入投票站签到记录和审计日志后,Heard 县 650 名提前现场选民中的多数、Cherokee 县 Ball Ground 投票中心全部 1860 名提前选民均可对应到具体选票。作者称全程未接触投票机、未入侵网络、未查看源代码,也未访问非公开数据,Agent 未拒绝执行。

  • 动态Quartz

    韩国警方调查利用中国 AI 工具 Artex 攻击 7 家金融机构事件

    韩国国家警察厅就一起利用中国开发的 AI 工具 Artex 发起的网络攻击展开调查,至少 7 家韩国金融机构受影响,6.8 万人的个人数据被泄露。调查人员称攻击最早于上周被发现,带有 Artex AI 的特征,该工具由中国安全工程师李普华(化名 Autumn)开发并以开源软件形式发布,原本用于帮助机构发现自身网络漏洞。据 BleepingComputer 报道,金融服务委员会召开紧急会议,确认新韩银行发生数据泄露,涉及 2.5 万名客户,国民银行 11.9 万客户的信用卡数据被泄露,韩亚银行销售支持系统被入侵后也发生有限泄露。攻击源自约十几个国家的二十多个 IP 地址,包括美国、日本和德国,官方尚未确认攻击者身份,并表示正寻求国际合作。事件公开后,Artex 修改了使用条款,明确禁止将其用于未授权访问、数据窃取或其他恶意用途。

  • 动态TechCrunch AI

    Mistral 发布 1T 参数多模态模型 Mistral Large 4,暂仅开放带护栏接口

    Mistral AI 发布 1 万亿参数多模态模型 Mistral Large 4(ML4),暂不开放权重,仅通过带护栏的公开接口访问,计划在安全测试完成后三周内开放权重。该模型完全基于 Mistral 自有算力训练,仅使用 4,000 块 Nvidia GPU,官方称比中国竞争对手少两到三倍。ML4 重点优化网络安全、金融和芯片设计等场景,基准测试结果尚未公布。

  • 动态The Decoder

    Mistral 发布万亿参数 Mistral Large 4,主打安全任务与欧洲主权

    Mistral 发布迄今最大模型 Mistral Large 4,总参数 1.05 万亿、激活 49 亿,采用细粒度 MoE 架构,上下文窗口 100 万 token,已在 Mistral Studio 开放 API 预览,权重预计 10 月底发布。在 Artificial Analysis 综合十项基准的 Intelligence Index 上,ML4 得 38 分,较前代 Mistral Large 3 的 9 分大幅提升,但落后于 Claude Opus 5.5 的 58 分,也低于 Anthropic、OpenAI、Google 的头部闭源模型及部分中国开源模型。公司称 ML4 在 JailbreakBench、StrongREJECT 和 AgentHarm 的恶意网络提示上拒答率高于其他开源模型,并在 Lakera B3 基准中拦截 93.3% 的攻击。

  • 动态GitHub 安全公告

    Langflow 修复多个组件默认关闭的 SSRF 防护漏洞

    Langflow 安全公告指出,部分接收 URL 的内置组件曾缺少有效的服务端请求限制。具备创建或运行流程权限的已认证用户可能借此访问服务器可达的内部资源。相关组件的防护分阶段补齐,并在 Langflow 1.10.3 完成公告所列修复;不同底层软件包的修复版本需分别核对。

  • 动态CNBC · Technology

    Mistral 推出 Large 4 公开预览,称可与中国领先开放模型竞争

    Mistral 发布 1 万亿参数模型 Mistral Large 4(代号 le Chonk),称其综合基准性能将位居全球开源权重模型前列,且是"中国以外"最强开源权重模型,但在编程等领域仍落后前沿水平。该模型在 Mistral 欧洲自有数据中心用 4000 块 Nvidia Grace Blackwell GPU 训练两个月,面向开发者、网络安全负责人及国家机构开放预览,本月晚些时候更广泛发布。Mistral 称其网络防御能力可帮助企业抵御利用越狱闭源模型发起攻击的威胁行为者。

  • 动态WIRED Security and AI

    Mistral 发布万亿参数开源权重模型 Mistral Large 4(Le Chonk)

    Mistral 发布万亿参数开源权重模型 Mistral Large 4(昵称 Le Chonk),目前为预览版,正式版将于本月底推出。该模型针对编程、网络防御及制造、金融、电气工程等垂直领域优化,Mistral 称其是能力最强的非中国开源权重模型,且从零训练、未使用知识蒸馏。

  • 动态The Decoder

    韩国拟投 3.49 万亿韩元打造本土前沿 AI 模型

    韩国计划通过政府股权投资 4.7 万亿韩元(约 34.9 亿美元)开发本土前沿模型,资金列入 2027 年预算草案,尚需国会批准。另一条资金轨道用于推动韩国自研模型在本国经济中的采用。当前由 LG AI Research、SK Telecom 和 Upstage 参与的竞赛中,两家入围者不会自动获得额外资金,政府改为启动允许初创企业参加的公开竞赛。官员承认韩国无法与最大的美国公司竞争,但可以比肩中国的领先开源模型。该竞赛启动时政府曾向五家入选企业承诺 5300 亿韩元(约 3.9 亿美元),新计划约为其九倍。

  • 动态Mistral AI

    Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型

    Mistral AI 推出 Mistral Large 4(ML4)公开预览 API,权重将于本月底发布。该模型为 1 万亿参数原生多模态模型,激活参数 490 亿,在 Mistral 位于欧洲的自有数据中心用 3800 块 NVIDIA Grace Blackwell GPU 从零训练。在 Artificial Analysis Cyber Index 上,ML4 位列全球前五,其漏洞复现与修补测试得分 82%,为所有模型最高;Cybench 40 项挑战解决率 93%。Mistral 正与网络安全机构及政府主管部门在降低审核、扩展网络能力的条件下对模型进行红队测试。

  • 动态The Decoder

    Reflection 发布开放权重模型 Beam,称性能超越中国以外所有开源模型

    Reflection 发布首个开放权重模型 Beam,采用 MoE 架构,每 token 激活 5010 亿总参数中的 230 亿,主打低算力下的编码、逻辑推理与智能体任务。Reflection 称 Beam 在推理任务上以少 3 至 4 倍算力达到 GLM 5.2 水平,SWE-bench Verified 得分 80.9,但原始性能仍不及 Kimi K3。模型权重将以 Apache 2.0 协议于本月晚些时候发布,目前仍在进行最终安全测试。

  • 动态Reflection

    Reflection 发布 Open Safety Framework,界定八类系统性风险与发布门槛

    Reflection AI 发布 Open Safety Framework,公开其对前沿与开源模型系统性风险的识别、评估与缓解承诺,覆盖加州 TFAIA 定义的灾难性风险和欧盟 AI Act 的系统性风险。框架列出八类风险,包括权力集中、生物武器、化学武器、网络攻击、失控,以及列为研究类风险的放射性武器、核武器和有害操纵。发布决策在集中风险与扩散风险之间权衡,默认开放发布,但当某项能力的直接危害可能既灾难性又不可逆时启用兜底机制。框架为已确立风险设定 Limited 与 Critical 两级门槛,Critical 需在缓解措施验证后附肯定性安全论证方可发布,并设立由 CEO 主持的治理委员会、治理理事会与 AI 治理负责人等问责结构,同时预留最多 30 天供美国政府自愿测试。

  • 动态The Decoder

    研究人员将 LeCun 的 JEPA 架构扩展为跨物理到生物学的通用世界模型 JEPA-Anything

    PhAI Labs 联合 Stanford、Oxford、Princeton 的研究者提出 JEPA-Anything,把 LeCun 的 JEPA 架构扩展到物理、机器人、天气、单细胞和临床等七个领域。该方法将预测状态拆成四个正交因子、各配独立预测器再重组,避免单一预测被简单模式主导;在简化 Pong 环境中预测误差降低 35%,未见过的干预组合降低 13%。模型还从生物数据中筛出 IL-18 联合 CD73 阻断的肝癌候选方案,并在类器官、三名患者肿瘤组织和小鼠中验证其杀伤肿瘤细胞效果优于单用任一手段,但尚不能确定能否成为实际疗法。

  • 动态The Decoder

    宁德时代与腾讯领投 DeepSeek 新一轮融资,公司计划 2027 年 IPO

    据 Bloomberg 报道,DeepSeek 即将完成新一轮融资,募资规模至少 120 亿美元,最初目标约为 75 亿美元、估值约 750 亿美元,知情人士称总额可能接近 150 亿美元,宁德时代与腾讯出资份额最大。投资者兴趣来自 DeepSeek 的 V4-Flash 模型,该模型在成本与性能上对标 Anthropic 和 OpenAI 创下新基准。融资完成后,DeepSeek 计划进行重组,于 2027 年初启动 IPO。公司正在建设一座使用至少 16 万颗华为 AI 芯片的数据中心,创始人梁文锋希望继续开发权重可自由获取的开源模型。此前因梁文锋关于公司依赖 Nvidia 芯片的言论引发关注,DeepSeek 曾暂停该轮融资;今年 6 月公司完成首轮外部融资,规模约 74 亿美元,估值超过 500 亿美元。

  • 动态The Hacker News

    Google 因无效自动化报告激增暂停开源产品漏洞奖励

    Google 自 10 月 1 日起停止通过开源软件漏洞奖励计划(OSS VRP)接收 Go、Angular、Protocol Buffers 等项目的产品漏洞报告,并在 X 上称原因是自动化提交大幅增加且绝大多数无效。供应链投毒类报告仍被接收,10 月 1 日前提交的报告不受影响。规则页面同步移除了旗舰项目 500 至 7500 美元、重要项目 101 至 3133.7 美元的产品漏洞奖励金额,Google 承诺在 2027 年第一季度更新该部分规则。研究者可改走 Cloud VRP、Patch Rewards 或其他奖励计划提交,Go 项目则要求通过其安全团队邮箱报告。

  • 动态ChosunBiz

    韩国警方成立专案组调查七家金融机构遭黑客入侵事件

    韩国警察厅10月6日宣布,针对近期多家银行遭黑客入侵事件,在核实客观事实后转为正式调查,并以违反《信息通信网利用促进及信息保护法》立案,同时组建由网络恐怖应对课长领导的专案组,下设4个小组共28人。据金融当局通报,新韩、KB国民、韩亚、BNK釜山银行、艺家蓝储蓄银行、Welcome储蓄银行和现代资本共7家机构确认遭到入侵。攻击商业银行的IP与攻击储蓄银行和资本公司的IP不同,但手法相似,攻击者疑似轮换多个国家的IP反复渗透金融机构系统。警方还在攻击银行业的IP上发现使用ARTEX AI的痕迹,这是一款利用大语言模型(LLM)寻找漏洞并尝试入侵的开源自主安全评估工具,金融当局正在调查攻击者是否借助此类AI工具对多家金融公司发动大规模自动化攻击。警方正与相关机构合作,并就是否符合重大犯罪调查机构(SCIA)通报标准征求金融委员会的解释。

  • 动态CNBC TV18 / Bloomberg

    DeepSeek 接近敲定至少 800 亿元人民币融资,腾讯与宁德时代为主要出资方

    DeepSeek 最新一轮融资接近敲定至少 800 亿元人民币(约 120 亿美元),超过其原定约 500 亿元的募资目标,按已签署条款最终规模可能接近 1000 亿元。腾讯与宁德时代在本轮中承诺了较大金额,此前腾讯曾在上一轮投入 100 亿元。知情人士称,融资完成后下一步是重组公司以筹备 2027 年初的 IPO,DeepSeek 最初目标估值约 5000 亿元。公司计划在内蒙古建设的数据中心部署至少 16 万块华为顶级加速器,并已公开与华为合作开发的 AI 芯片编程软件。创始人梁文锋在与投资者的会面中表示将继续开发开源模型,并把实现 AGI 作为更广泛目标。

  • 动态latent.space

    Reflection 发布 Beam:501B-A23B 美国开源模型

    Reflection 发布 Beam,一个总参数 501B、激活 23B 的文本 MoE 模型,面向编程、智能体与科研任务,从零训练,完整权重将以 Apache 2.0 协议于本月开放。其预训练使用 23.8T token,并在约 10,500 块 GB300 上完成约四周预训练与四周 RL,自称 SWE-bench Verified 得分 80.9。Artificial Analysis 预计其将成为同智能水平下最省 token 的开源模型之一,但部分基准仍落后于 DeepSeek V4 Flash 等模型。