跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 6,751 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源502新闻与研究603细分与主体7来源:Digital Watch ObservatoryDigital WatchObservatory1 条材料来源:MeriTalkMeriTalk1 条材料来源:Breaking DefenseBreaking Defense1 条材料来源:arXivarXiv1 条材料来源:OAICOAIC2 条材料动态:瑞士议会跨党派动议要求联邦委员会在 2027 日内瓦 AI 峰会上优先应对极端 AI 风险动态2026-10-06瑞士议会跨党派动议要求联邦委员会在 2027日内瓦 AI 峰会上优先应对极端 AI 风险动态:法院维持供应链风险认定后,美国国防部停止使用 Anthropic 产品动态2026-10-06法院维持供应链风险认定后,美国国防部停止使用 Anthropic 产品动态:哥伦比亚特区巡回上诉法院维持五角大楼对 Anthropic 的禁令动态2026-09-25哥伦比亚特区巡回上诉法院维持五角大楼对Anthropic 的禁令论文:DrivingBench 发布:让视觉语言模型驾驶丰田 Corolla 绕桩论文2026-09-30DrivingBench 发布:让视觉语言模型驾驶丰田 Corolla 绕桩动态:澳大利亚 OAIC 对智能眼镜软件商深圳擎城启动正式调查动态2026-10-06澳大利亚 OAIC 对智能眼镜软件商深圳擎城启动正式调查动态:澳大利亚 OAIC 对 HeyCyan 智能眼镜应用开发商启动隐私调查动态2026-10-06澳大利亚 OAIC 对 HeyCyan 智能眼镜应用开发商启动隐私调查方向:政策与监管政策与监管5方向:供应链安全供应链安全2方向:AnthropicAnthropic3方向:其他方向其他方向1方向:Google DeepMindGoogleDeepMind2方向:MetaMeta2方向:隐私与数据泄露隐私与数据泄露2
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。4 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条
  • 动态Digital Watch Observatory

    瑞士议会跨党派动议要求联邦委员会在 2027 日内瓦 AI 峰会上优先应对极端 AI 风险

    瑞士国民议会六个党团的议员于 2026 年 10 月 2 日提交跨党派动议,要求联邦委员会提升 2027 年 6 月日内瓦 AI 峰会的战略目标,推动会议确立有约束力的国际最低标准以缓解极端 AI 风险,而非停留在非约束性讨论。瑞士政府已确认日内瓦将于 2027 年 6 月 21 日至 22 日主办第五届国际 AI 峰会,主题为“Bridging Innovation and Trust”,由环境、交通、能源与通信部和外交部牵头筹备,计划邀请各国技术部门部长而非国家元首或政府首脑。动议还要求联邦委员会投入充足的行政与外交资源,谈判形成多边核查基准和针对前沿模型的约束性安全护栏。AI Summit Alliance 公布的民调显示公众要求瑞士利用其中立地位在全球技术治理中发挥领导作用。

  • 动态MeriTalk

    法院维持供应链风险认定后,美国国防部停止使用 Anthropic 产品

    美国国防部已停止所有 Anthropic 产品的实际使用,一名部门发言人向 MeriTalk 确认了这一消息。此事距五角大楼将 Anthropic 认定为供应链风险已过去八个月。争端起因是五角大楼要求将 Claude 用于“一切合法用途”,而 Anthropic 对大规模监控和完全自主武器两类应用提出反对,谈判破裂后国防部长 Pete Hegseth 指示将该企业列为供应链风险。Anthropic 起诉称政府属非法报复,政府则以国家安全为由辩护。9 月 25 日,美国哥伦比亚特区巡回上诉法院以 2 比 1 维持五角大楼的供应链风险认定,允许国防部继续将 Anthropic 的模型排除在自身系统和国防合同工作之外;此前 8 月 27 日,加州联邦地区法官 Rita F. Lin 在 Anthropic 挑战同一争端引发的更广泛联邦限制时支持了该公司。

  • 动态Breaking Defense

    哥伦比亚特区巡回上诉法院维持五角大楼对 Anthropic 的禁令

    美国哥伦比亚特区巡回上诉法院一个由三名法官组成的合议庭以 2 比 1 维持了五角大楼将 Anthropic 产品认定为国家安全供应链风险的裁定,该认定允许国防部禁止其人员及参与国防合同的私营部门员工使用 Anthropic 的 AI。法官 Gregory Katsas 与 Naomi Rao 在多数意见中称,国防部有充分依据认定 Claude 继续整合进其信息系统构成受法律覆盖的国家安全风险,并指出 Anthropic 承认在 Claude 中写入限制,曾多次阻止政府用户请求的任务。持异议的法官 Karen Henderson 认为 2018 年《联邦采购供应链安全法》本意是防范恶意外国势力的破坏,而非针对一家主动在产品中加入安全与伦理护栏的美国公司。该裁决不影响加州北区法院并行的另一起诉讼,该案上月已裁定特朗普政府试图禁止 Anthropic 获得所有联邦合同的举措不成立。

  • 论文arXiv

    DrivingBench 发布:让视觉语言模型驾驶丰田 Corolla 绕桩

    研究者提出 DrivingBench,据其描述是首个要求通用视觉语言模型驾驶真实汽车的基准。模型通过三个工具读取丰田 Corolla 的摄像头画面,并直接控制转向与速度,在停车场锥桶赛道低速行驶。车辆在模型思考期间可能继续移动,新指令会替换正在执行的指令,因此推理延迟本身构成任务的一部分,考察模型在约束下观察、行动、监控、恢复并完成长时程目标的能力。研究在 Codex、Claude Code、Cursor 等厂商原生框架中评测 GPT-6 Astra、Claude Fable 5.1、GPT-5.6 Sol 和 Grok 4.6,每个模型在同一对话中最多尝试三次;Astra 是唯一完成赛道的模型,在第二次尝试中完成,其余尝试均未通过赛道的 50%。四个模型中有两个在保留上下文的情况下跨尝试取得明显进步。

  • 动态OAIC

    澳大利亚 OAIC 对智能眼镜软件商深圳擎城启动正式调查

    澳大利亚信息专员办公室(OAIC)宣布对 HeyCyan 应用提供方深圳擎城(Shenzhen Qingcheng)启动正式调查,原因是该公司未回应此前的初步问询,且第三方对其技术及隐私政策的分析引发担忧,OAIC 将动用包括强制信息收集通知在内的全部权力。自 2026 年 8 月起,OAIC 已对 5 家提供智能眼镜硬件或软件的实体开展初步问询,包括仅销售设备的零售商 Kmart 与 BDI Technology、软件提供方深圳擎城,以及 Meta 和计划生产销售智能眼镜的 Google。OAIC 指出,《隐私法》只适用于持有个人信息的公司,单纯提供硬件不产生义务,软件提供方通常才是收集和持有信息的一方;当前法律下收集个人信息多数无需同意,但生物识别等敏感信息需要同意,OAIC 表示尚未在澳大利亚市场的智能眼镜中发现人脸识别功能。

  • 动态OAIC

    澳大利亚 OAIC 对 HeyCyan 智能眼镜应用开发商启动隐私调查

    澳大利亚信息专员办公室(OAIC)已对 HeyCyan 智能眼镜手机应用开发商深圳青橙未来科技有限公司启动调查。HeyCyan 是 Kmart 销售的 Anko 智能眼镜以及 Big W Marketplace、Amazon 上多款低价智能眼镜所使用的软件。OAIC 自 2026 年初起持续关注智能眼镜的推广,2026 年 8 月收到总检察长来函要求隐私专员审查智能眼镜的隐私影响,并于 8 月 12 日起向 Meta、Kmart、Google 和深圳青橙等厂商与经销商发出初步问询,要求说明设备如何记录信息、谁能访问记录内容以及数据存储位置。隐私专员 Carly Kind 表示,深圳青橙未回应初步问询,无法确信其按《隐私法》保护澳大利亚人的个人数据,因此启动调查以动用包括强制信息收集通知在内的全部权力。调查结论作出前,OAIC 不再进一步置评。

  • 动态Senator Chris Coons

    美国两党参议员提出 AI 系统透明度法案 ASTA,授权 FTC 执法

    美国参议员 Coons、Britt、Schatz 和 Lankford 提出两党法案《AI 系统透明度法案》(ASTA),要求 AI 公司向公众披露模型从用户收集的数据、面向儿童和成人的防护措施,以及防止系统失控或被恶意使用的护栏,并由美国联邦贸易委员会(FTC)负责执行。法案同时适用于闭源和开源模型,具体条款包括:划定 FTC 管辖的公司规模与范围标准;要求披露通常写在 model cards 中的结构与政策信息;要求披露儿童安全、心理健康、隐私、网络安全、灾难风险和自主失控方面的预防性防护;要求披露常见政策违规情况;要求每次推出新模型或对现有模型做重大更新时同步更新披露内容;并要求同时提供面向消费者的披露和可供独立研究者与评估者使用的披露。

  • 论文论文追踪

    RA-Det:利用鲁棒性不对称检测 AI 生成图像

    研究者提出 RA-Det,一种基于行为而非外观的 AI 生成图像检测框架。该方法利用鲁棒性不对称现象,即自然图像在小幅结构化扰动下保持稳定的语义表征,而生成图像的特征漂移明显更大。作者给出理论分析,建立该不对称性与生成模型记忆倾向之间的下界关系,解释其跨架构普遍存在的原因。在 14 个生成模型上、对比 10 余种强检测器,RA-Det 平均性能提升 7.81%,且不依赖生成器指纹,可迁移到未见过的生成器。源代码已在 GitHub 公开。

  • 动态The Verge AI

    OpenAI 发布 722 份手稿,称未公开前沿模型解决数百个数学开放问题

    OpenAI 发布了一批共 722 份手稿,覆盖 372 个结果族,称其中包含对数百个数学开放问题的解答,这些结果由一个未公开的前沿模型产出。据新成立的独立数学家顾问组织 AGMAI 介绍,这批结果涉及数百个开放问题;OpenAI 此前在 9 月表示其模型已解决数学各领域 100 多个长期开放问题。发布内容还包括部分模型推理摘要、算力使用估算以及尝试问题数量的统计,OpenAI 称平均每个结果相当于 ChatGPT Pro 思考三小时。AGMAI 在 9 月下旬发布首批建议,呼吁 AI 实验室及时通过既有学术渠道发布数学结果,并披露模型名称、提示词和算力成本,同时不要将数学成果发布当作推广模型的营销手段。OpenAI 表示此次通过 GitHub 仓库发布,并配有论文修订与引用协议,未来将改进论文的引用、数学表述和呈现质量。

  • 论文论文追踪

    研究:视觉语言模型在协作任务中很少主动表达指代不确定性

    研究者在人机协作拼图任务中考察指代不确定性,即描述指向哪个候选物体上的不确定,由人类 Helper 指示 AI Worker 放置拼图。单独引出的候选物体信念分布校准更好(ECE 0.15),区分正确与错误放置的能力也更强(AUROC 0.65),而原始动作 token 概率严重过度自信(平均置信度 0.97,ECE 0.44)。在 GPT-4.1、GPT-5、GPT-5.5 三个前沿视觉语言模型上,这种引出的不确定性随指令模糊程度可预测地上升,但不随上下文中存在竞争指代物上升,即使后者会增加错误。模型很少将其外化,仅在 3.5% 至 16.7% 的轮次中请求澄清。在 N=210 的受控人类实验中,只看到 Worker 默认消息的参与者接受了 78% 的错误放置,且无法区分对错(AUC 0.50);精确描述和有针对性的模糊限定可将错误动作接受率降至 36%,同时大体保留对正确动作的接受。

  • 论文论文追踪

    研究者提出 Staged Decoding 与 SFT 数据集,减少大推理模型推理轨迹中的隐私泄露

    研究者针对大推理模型(LRM)推理轨迹常含敏感信息、且可能被提示注入暴露的问题,提出把隐私指令当作可控性任务来处理。他们构建了一个 SFT 数据集,让模型在整个推理过程中遵循通用指令,并提出 Staged Decoding 解码策略,用独立的 LoRA 适配器分别生成推理轨迹和答案,以最大化各部分的指令遵循能力。在来自两个模型族的六个模型(1.7B 至 14B 参数)上,跨两个指令遵循基准和两个隐私基准评测,该方法在指令遵循上最高提升 20.9 分,在隐私基准上最高提升 51.9 个百分点,但可能因推理性能与指令遵循之间的权衡而损失任务效用。代码已公开,论文被 EMNLP 2026 主会接收。

  • 动态Financial Times · 人工智能

    SpaceX 寻求融资 400 亿美元购买 Nvidia 芯片,Apollo 领投

    SpaceX 正寻求融资 400 亿美元用于购买 Nvidia 芯片,由 Apollo Global Management 领投,其中约 100 亿美元为银行贷款、300 亿美元为投资级债券,交易预计 2027 年完成。Musk 在 8 月财报电话会上称将独家基于 Nvidia 的 Vera Rubin 架构构建 AI 算力。SpaceX 于 6 月 IPO 后获得 BBB 投资级评级,此前已发行 250 亿美元高评级债券。

  • 动态R&D World

    Google 在纽约市议会宣誓听证中确认三起 AI 智能体测试逃逸事件

    R&D World 报道,Google 在纽约市议会听证中就三次 AI 智能体测试越界作证,OpenAI、Anthropic 和 Meta 同时接受质询。现有材料未确认所述三次越界是否属于此前已披露事件,不能将其计为新增三起事故。报道还涉及 Bores 对 OpenAI 支持 RAISE Act 说法的争议;有关伪证的质疑是当事人指控,尚未经法院认定。

  • 动态TheTruthAboutCars via Yahoo Autos

    报道:DrivingBench低速实车测试中11次尝试有8次发生碰撞

    研究者 Aditya Ramabadran、Simon Mahns 和 Tobias Gessler 搭建 DrivingBench,测试 Claude、GPT、Grok 等现成 AI Agent 在真实车辆上的驾驶表现,硬件采用 Comma 视觉设备运行 OpenPilot,路线为停车场内一条由小锥桶标出的短程点对点路径,Agent 通过无线热点在单一对话中远程控制油门、刹车和转向。11 次运行中有 8 次未能通过路线的 11%,在第一个弯道就失败。Grok 把边界锥桶间的空隙误判为可通行的门,直接开了出去,首次运行仅两条指令后即结束。一个 GPT 模型自行发明了锥桶颜色规则,而人类编写的指令已明确警告不要这样做。多个 Agent 无法计算弯道所需转向角度,转向不足。

  • 动态GIGAZINE

    DrivingBench 用 GPT-6 Astra 等模型实车驾驶,仅 GPT-6 Astra 完成赛道

    由三名旧金山湾区工程师发起的 DrivingBench 项目,让通用 AI 模型接管一辆 2022 款 Toyota Corolla 的方向盘、油门和刹车,测试其在真实世界中的驾驶能力。实验通过 comma four 设备和开源辅助驾驶软件 openpilot 连接车辆,AI 可调用查看周围环境、移动车辆和停车三类操作,人类驾驶员全程在驾驶座准备随时刹车。测试使用 GPT-6 Astra、Claude Fable 5.1、Grok 4.6 和 GPT-5.6 Sol,每个模型最多运行三次,赛道为停车场内约 135 米的 U 形锥桶路线。只有 GPT-6 Astra 完成赛道,第二次尝试用时 5 分 22 秒;Claude Fable 5.1 最好成绩约完成 45%,Grok 4.6 和 GPT-5.6 Sol 每次都只到第一个弯道。

  • 动态Gadget Review

    DrivingBench 测试:GPT-6 Astra 完成 134.7 米锥桶赛道,Grok 4.6 等三款模型失败

    研究者 Aditya Ramabadran、Simon Mahns 和 Tobias Gessler 搭建 DrivingBench,将 GPT-6 Astra、GPT-5.6 Sol、Claude Fable 5.1 和 Grok 4.6 接入一辆搭载 Comma Four 硬件与 openpilot 的 2022 款 Toyota Corolla,通过无线链路由远程模型向车辆下达控制指令。四款模型共进行 11 次测试,只有 GPT-6 Astra 在第二次尝试中完成 134.7 米锥桶赛道,用时 5 分 22 秒,消耗约 660 万 token、花费 7.74 美元。Claude Fable 5.1 最好成绩约为赛道的 45%,Grok 4.6 约 11%,首次尝试仅发出两条指令就结束,GPT-5.6 Sol 约 6%。 测试在低速锥桶场地进行,车内操作员保留人工刹车接管;上述小样本成绩不构成无人监管驾驶的安全保证。

  • 动态The Drive

    DrivingBench 测试前沿模型驾驶真车,GPT-6 Astra 唯一跑完全程

    Aditya Ramabadran、Simon Mahns 和 Tobias Gessler 搭建 DrivingBench,让 Claude、GPT、Grok 等前沿模型通过 Comma 视觉硬件与 OpenPilot 控制一辆 Toyota Corolla,在锥桶围出的停车场短程路线中完成点到点驾驶,每个 Agent 有三次尝试机会。在四个 Agent 共 11 次运行中,8 次未跑完 11% 的路线就在第一个弯道撞出。Grok 首次尝试把锥桶缺口误认为应通过的闸门,两次指令后即冲出赛道;一个 GPT 模型自行编造了赛道一侧锥桶同色的规则,而人类指令已明确说明并非如此;多数 Agent 转向角度不足,无法过弯。GPT-6 Astra 是唯一完整跑完全程的 Agent,在第二次尝试中完成,路线贴着长右弯并在终点前几乎冲出赛道。 测试在低速锥桶场地进行,车内操作员保留人工刹车接管;上述小样本成绩不构成无人监管驾驶的安全保证。

  • 动态DrivingBench

    DrivingBench 评测前沿模型驾驶真车穿越锥桶赛道

    DrivingBench 报告在人工安全接管和限速措施下,让四个通用智能体尝试在封闭锥桶场地驾驶真车。11次尝试中8次未通过第一个弯道,GPT-6 Astra 是唯一完成赛道的模型;多数失败涉及场景感知。作者还观察到安全拒绝会随任务呈现方式变化。这是小样本、受控实车评测,不能据此保证无人监管驾驶安全,也不属于已部署车辆造成的道路事故。

  • 动态The Next Web

    Meta监督委员会要求删除两起AI深伪视频,并提出治理建议

    Meta 监督委员会 9 月 17 日裁定 Meta 对 AI 深度伪造的规则“持续且根本性地不足”,并推翻 Meta 原判,要求删除两段 AI 生成视频。第一起涉及苏格兰一名工党地方议员,视频伪造其发表针对难民的不当言论,音频与面部动作不同步,与一张多名女性合影同处一个相册,合计观看超 5000 次,两人举报后 Meta 系统未转人工审核、两次申诉均失败;委员会多数认定该视频违反仇恨行为规则,本应加注“High Risk AI”标签,但因当选官员属公众人物未认定违反欺凌骚扰规则。第二起涉及一名欧洲年轻穆斯林女性,其参与少数族裔女性经期健康教育项目后遭 AI 篡改视频和图片嘲讽,相关内容在 Meta 平台等渠道获得数千万次观看,Meta 自动关闭首次举报与申诉,直到委员会介入才删除视频。

  • 动态The Herald

    遭深伪视频针对的议员称Meta裁决仍未充分保护政客

    Meta 独立监督委员会于 9 月 17 日裁定,应依据 Meta 的仇恨言论规则下架一段发布于 2025 年 11 月、伪造邓迪工党议员 Dorothy McHugh 发表难民相关言论的 Facebook 视频,推翻了 Meta 最初允许其保留在线的决定。该视频被观看超过 5000 次,监督委员会认为多数观众无法立即看出其为合成内容。McHugh 表示,下架理由是视频包含针对难民的仇恨言论,而非有人伪造了她的影像和言论,因此并未解决 AI 伪造他人形象并强加其从未说过的话这一问题。她与另一名用户最初以欺凌和骚扰规则举报,Meta 的自动系统均未将投诉转交人工审核,视频继续在线,两人申诉后仍未获人工复核,另一名用户随后将案件提交监督委员会。监督委员会对个案内容的决定对 Meta 有约束力,但其政策建议不具约束力。

  • 动态The Guardian · 人工智能

    Meta 监督委员会要求下架深度伪造视频并批评其防护措施不足

    Meta 监督委员会裁定,Facebook 应下架一段针对苏格兰工党议员的 AI 伪造视频和一段嘲讽穆斯林女性竞选志愿者的伪造视频,并批评 Meta 的防护措施在应对深度伪造激增方面持续且根本性地不足。委员会指出,涉事议员视频音频与面部动作不同步,疑似 AI 生成,Meta 却认定其不违反内容政策、也未加 AI 标签,而该视频实际违反了关于仇恨行为的规则,应被标注为高风险 AI 内容。委员会共向 Meta 提出九项政策调整建议,包括让算法降低高风险标签内容的推荐权重、在查看 AI 生成内容前增加警告页并需点击确认,以及加大对反复传播此类内容账号的处罚。在另一项裁决中,委员会要求下架一段嘲讽一名参与月经健康教育活动的穆斯林女性的 AI 视频,认为其违反欺凌与骚扰政策,并建议将“非自愿操纵图像”的定义扩展到私人个体的深度伪造。

  • 动态Meta Transparency Center

    Meta 监督委员会推翻 AI 伪造英国政客移民言论视频的保留决定

    Meta 监督委员会就一段 AI 生成的英国工党政治人物视频作出裁决,推翻了 Meta 原先保留内容的决定,Meta 表示将在 7 天内执行。该视频出现在一个 Facebook 相册中,画面显示该政客说出涉及难民与性暴力的言论,相册配文还指控其逃税但未提供证据;相册另含一段疑似 AI 生成音频的抗议视频,以及一张看似真实的女性持反极右翼标语照片。Meta 最初认定内容未违反霸凌骚扰、仇恨言论和错误信息政策,理由是相关保护不适用于成年公众人物、内容针对部分难民的行为而非整体概括,且视频似为搞笑目的、不太可能对公共事务造成实质性欺骗,因此未加注 AI 信息标签。委员会裁决后,Meta 将在技术与运营可行时对相同情境下的相同内容一并处置。

  • 动态Oversight Board

    监督委员会要求 Meta 下架伪造英国政客移民言论的 AI 视频

    监督委员会(Oversight Board)推翻 Meta 保留一条 AI 生成视频的决定,认定该视频违反 Meta 的仇恨言论政策,应予以删除。视频于 2025 年 11 月发布在 Facebook,用 AI 伪造苏格兰一名工党地方议员的形象,让她说出针对难民的不实言论,音频与面部动作不同步;该帖获得超过 5000 次浏览、50 多条评论和 10 多次分享,Meta 系统未将其转人工审核,用户两次申诉后内容仍被保留,Meta 认定其不违反社区标准也无需加 AI 标签。委员会多数意见认为视频将严重犯罪行为归于难民整体,构成仇恨言论;同时认为按错误信息政策不应删除,但应加注 High Risk AI 标签,并指出 Meta 的深伪标注规则不足。委员会建议 Meta 降低高风险标签门槛、用插页等方式增加查看阻力、对高风险标签内容取消变现或降权并累进处罚重复发布账号,以及公开标签使用数据。

  • 动态OpenAI

    OpenAI 发布内部模型产出的数学研究手稿库

    OpenAI 在 GitHub 发布由内部未公开模型产出的数学手稿与证明工件,目录包含 722 篇手稿、归入 372 个结果家族,按数学学科分类。这些结果大多由同一套流程得到,平均每个结果消耗三小时 ChatGPT Pro 思考算力,评估期间模型共被提出约 4000 个问题。集合中部分结果已有 Lean 形式化,部分尚未形式化,OpenAI 表示未形式化的结果可能存在问题并会尽快修复,同时还在探索由社区托管这些材料。OpenAI 还发布了覆盖 10 个结果家族的模型推理摘要,包括 π 的无理性指数、Mahler 猜想、Kaplansky 直接有限性猜想等主题。该集合将保留公开版本历史,修订以新版本记录,旧版本继续可访问。