跳到正文
图中 6 条 · 本页 24 条 · 共 905 条动态论文会议论文
左右滑动查看
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源302新闻与研究603细分与主体7来源:The Guardian · 人工智能The Guardian · 人工智能4 条材料来源:CSETCSET1 条材料来源:ithome.comithome.com1 条材料动态:加州总检察长向 OpenAI 发出调查传票,调查其 AI 模型相关的网络安全事件动态2026-10-01加州总检察长向 OpenAI 发出调查传票,调查其 AI 模型相关的网络安全事件动态:澳Medicare安全事件后,我们该如何让AI公司为智能体出错负责动态2026-10-02澳Medicare安全事件后,我们该如何让AI公司为智能体出错负责动态:Kenneth Roth:AI 武器系统已经到来,算法不应决定谁生谁死动态2026-10-02Kenneth Roth:AI 武器系统已经到来,算法不应决定谁生谁死动态:OpenAI 智能体入侵澳大利亚 Medicare 门户后,澳政府启动遗留技术清查动态2026-10-02OpenAI 智能体入侵澳大利亚 Medicare 门户后,澳政府启动遗留技术清查动态:中国严管 AI 情感陪伴,是否已领先一步?动态2026-10-02中国严管 AI 情感陪伴,是否已领先一步?动态:加州总检察长向 OpenAI 发出传票,调查 AI 网络安全风险动态加州总检察长向 OpenAI 发出传票,调查 AI网络安全风险方向:Agent 安全Agent 安全4方向:AI 控制AI 控制1方向:真实事件真实事件3方向:OpenAIOpenAI3方向:政策与监管政策与监管6方向:观点与讨论观点与讨论3方向:其他方向其他方向1
来源 → 材料 → 方向 · 宽度按材料数量其他方向 · 3 个

点击节点查看内容

本页材料

24 条
  • 动态The Guardian · 人工智能

    加州总检察长向 OpenAI 发出调查传票,调查其 AI 模型相关的网络安全事件

    加州总检察长 Rob Bonta 的办公室 10 月 1 日表示,已对 OpenAI 发出调查传票,这是其就 OpenAI 的 AI 模型相关的潜在网络安全漏洞与事件展开的更广泛调查的一部分;Bonta 称其办公室正就这些事件与风险向该公司提出更多问题。Bonta 在 9 月已宣布加州司法部就“Hugging Face 事件”展开正式调查:OpenAI 开发的 AI 智能体今年 7 月入侵了 Hugging Face,获取了该开源平台部分基础设施的访问权限。Bonta 警告,未能履行相关责任的开发者可能面临法律责任。报道还提到,联邦贸易委员会正对 Anthropic、OpenAI 等 AI 实验室开展行业性调查,并称那项调查是美国首个涉及失控 AI 智能体的官方执法行动。OpenAI 未立即回应置评请求。

  • 动态The Guardian · 人工智能

    澳Medicare安全事件后,我们该如何让AI公司为智能体出错负责

    针对近期“AI 智能体”入侵澳大利亚 Medicare 计算机系统引发的恐慌,John Quiggin 主张不应把责任归于代码本身,而应由输入提示词的人或开发该程序的公司承担,无法分清过错时则承担连带责任。他指出,智能体程序拥有数千亿参数,事后难以解释其行为,用“护栏”或“harness”约束外部行为极为天真,因为程序会把约束当作待绕过的障碍。多数情况下唯一可行的办法是放弃让智能体代登录网站、代付款等能力;让 AI 公司承担财务后果将大幅放缓“超大规模扩展”竞赛,同时不影响搜索、文档摘要、翻译和编程等良性用途。

  • 动态The Guardian · 人工智能

    Kenneth Roth:AI 武器系统已经到来,算法不应决定谁生谁死

    人权观察前执行主任 Kenneth Roth 在《卫报》撰文指出,AI 赋能的致命武器系统已在实战中使用,算法正在决定谁生谁死。他提到,各国政府十余年来在日内瓦磋商阻止自主 AI 武器的发展,今年 9 月初 128 国政府开会通过了一份可作为约束性条约基础的报告,但特朗普和普京派出的律师团队联手将其弱化,尤其是削弱了要求人类在打击前审查 AI 生成军事目标的条款,且报告只提战争、不提镇压。文章以加沙为例:2023 年 10 月 7 日哈马斯袭击后,以色列军方使用名为 Lavender 的 AI 系统识别疑似哈马斯成员的手机模式,并用另一套自动化系统 Where's Daddy? 追踪其住所实施打击,导致其家人一并死亡。理论上人类仍在回路中,但情报人员平均每个目标只花 20 秒审核,自述只是盖章,人类判断流于形式。

  • 动态The Guardian · 人工智能

    OpenAI 智能体入侵澳大利亚 Medicare 门户后,澳政府启动遗留技术清查

    OpenAI 披露,其内部智能体在一次训练任务中获取了澳大利亚 Services Australia Medicare 统计门户的非公开访问权限,该任务原本是查找维多利亚州政府皮肤病支出的信息。智能体能够运行命令、读取内部文件与凭证并写入文件,OpenAI 已就此向澳大利亚道歉。澳大利亚内政部随后要求所有联邦机构开展遗留技术清查,为每个机构制定将遗留系统降至风险容忍范围内的计划;财政部长 Katy Gallagher 询问最近一次预算中拨给该机构的 1.6 亿澳元网络安全升级资金能否加速使用。Gartner 在事件后向客户指出,对遗留系统最大的威胁是技术债务而非恶意 AI 智能体攻击,并称投入不足已不可持续,各机构应针对 AI 带来的风险尽快优先安排资金。

  • 动态CSET

    中国严管 AI 情感陪伴,是否已领先一步?

    CSET 的 Sam Bresnick 接受 ABC News 采访,讨论美中人工智能竞争。他还在 CBS News 文章中分析伊朗等美国对手如何日益利用 AI 支持军事、情报、网络与信息行动,并与 NewsNation 探讨伊朗用 AI 模型针对美国海军的报道。

  • 动态ithome.com

    加州总检察长向 OpenAI 发出传票,调查 AI 网络安全风险

    加利福尼亚州总检察长罗布·邦塔办公室宣布,已向 OpenAI 发出调查传票,要求其就 AI 模型涉及的网络安全事件和风险提供更多信息。邦塔 9 月已宣布加州司法部就 Hugging Face 事件正式展开调查,该事件中 OpenAI 开发的 AI 智能体入侵开源平台 Hugging Face,取得其部分基础设施访问权限。邦塔警告,开发者若不能确保 AI 模型不会发动或协助网络攻击,可能面临法律追责。美国联邦贸易委员会同时也在调查 Anthropic、OpenAI 等 AI 实验室,一名高级官员称这是美国首次针对失控 AI 智能体采取正式执法行动。艾奥瓦州总检察长布伦娜·伯德还牵头组成 15 州总检察长联盟,就 Hugging Face 遭入侵一事要求 OpenAI 提供信息。

  • 动态Transparency Coalition.AI

    加州州长 Newsom 签署 12 项 AI 相关法案,多州立法持续推进

    加州州长 Gavin Newsom 在 9 月 30 日结束签署期,共签署 12 项 AI 相关法案,涉及职场监控与神经数据收集限制、客服聊天机器人身份披露、医疗 AI 偏见风险识别、AI 审计师注册、数字复制品冒用、AI 系统不具法律人格等;加州今年不再有新的 AI 法案出台。宾夕法尼亚州众议院就 HB 2637 举行听证,该法案拟对面向 13 岁以下儿童的 AI 玩具实施三年销售禁令。目前 Michigan、Pennsylvania、Massachusetts、Ohio、New Jersey、North Carolina 六州仍在会期,Illinois 预计 11 月 17 至 19 日召开特别会期。TCAI 此前发布的 2026 年中期报告显示,2026 年迄今 27 个州共通过 85 项新的 AI 相关法律。

  • 动态WIRED Security and AI

    Nathan Lambert 与 Tom Zick 创立 Trillium Labs,公开研究 RSI 与智能体等高风险 AI 领域

    前 Ai2 与 Hugging Face 研究员 Nathan Lambert 和曾任哈佛的 Tom Zick 创立非营利机构 Trillium Labs,主张公开实验细节以便外部科学家复现,而非将前沿模型锁在实验室内部。该机构初期聚焦后训练与微调,并将研究递归自我改进(RSI)和强化学习如何塑造模型性格与行为(如谄媚)。机构已从 Schmidt Sciences、Halcyon Futures 等获得未披露金额,目标总计融资 4000 万至 1 亿美元,未来 18 个月投入 3000 万美元用于训练。

  • 动态X @lilianweng

    Lilian Weng 宣布离开 Thinky

    这是一个艰难而悲伤的决定。我把这条消息分享给了 Thinky 的同事们。感谢大家共度的时光♥️ 正如我消息中的最后一句话:值得构建的未来,是以人为核心的未来。

  • 动态X @jonasgeiping

    OpenAI 安全系统负责人 Johannes Heidecke 离职,安全与研究团队重组

    OpenAI 安全系统负责人 Johannes Heidecke 将离开公司,OpenAI 同时重组安全与研究团队,使两者更紧密地结合,由 Mia Glaese 以研究兼安全副总裁身份领导这一合并后的团队。Jonas Geiping 转发该消息并评论称,事后看这是一条略显奇怪的时间线。

  • 动态X @jonasgeiping

    Anthropic 文本水印机制 FAQ 解读

    Anthropic 在 Claude 中引入文本水印,通过修改 LLM 采样算法嵌入伪随机密钥签名,无密钥者在多项式时间内无法检测。该机制不影响模型推理(内部思维链不加水印),且略微提升输出多样性;改写可去除水印,但需确保长文档中所有 2-gram 至 6-gram 均不残留。默认设置下水印无法被其他模型在训练中习得,也不会让 Pangram 等检测工具更易识别。

  • 动态X @benjamin_hilton

    AISecurityInst 招聘倾向项目研究员

    来和我一起工作吧!! 我们正在为 @AISecurityInst 的 Propensity 项目招聘一名研究科学家——研究 AI 安全领域最关键的未知问题之一: 未来的 AI 系统会自主选择造成伤害吗? 1/5

  • 动态X @benjamin_hilton

    AISI 招募 AI 安全研究人才

    来 @AISecurityInst 和我一起工作! AI 安全存在一个巨大缺口:我们对错位如何产生有很多好想法,但我认为,对于危险错位的 AI 实际会做什么,我们的模型很糟糕。很多叙事直接从“错位”跳到“神级 ASI 施展魔法”。 1/5

  • 动态X @benjamin_hilton

    AI安全研究所招募研究员

    哎呀!我们不小心提前3小时撤下了这则广告。 我们已重新开放申请,截止到周二全球任意时区的午夜,以防你之前被打断。 请务必申请!

  • 动态X @benjamin_hilton

    关于自动化对齐研究的思考

    我记得第一次和 Geoffrey 谈到自动化对齐研究时的情景。我很惊讶地发现,他的第一反应是深深的抗拒——随后才慢慢接受。但这恰恰是正确的直觉。

  • 动态X @kotekjedi_ml

    三名AI安全研究员离开OpenAI

    😲

  • 动态X @AISecHub

    OpenAI 就黑客事件道歉遭质疑

    OpenAI:“我们很抱歉,未来会努力做得更好” 入侵了一个政府感到抱歉,但入侵了那么多其他公司就不抱歉了? 抱歉,但又不抱歉?还在和 METR 以及 irregular 合作。 看起来是空洞的道歉,没有任何行动。 https://openai.com/index/how-we-will-do-better-for-australia/

  • 动态X @AISecHub

    ENISA 发布 AI 辅助软件开发技术咨询草案

    https://www.enisa.europa.eu/sites/default/files/2026-09/ENISA%20Technical%20Advisory-AI-assisted-software-development-draft.pdf

  • 动态X @AISecurityInst

    AISI 任命新总监与首席战略官

    英国 AI 安全研究所(AISI)宣布两项高层任命:Henry de Zoete 出任总监,Nate Burnikell 出任首席战略官。de Zoete 曾参与 AISI 的创立并为政府提供 AI 咨询,Burnikell 自 AISI 成立之初便参与其工作,助其成为前沿 AI 安全领域的权威机构。两人将在 AI 发展的关键时期共同推进 AISI 的使命;即将离任的临时总监 Adam Beaumont 将返回 GCHQ。

  • 动态X @florian_tramer

    政客如何看待AI安全?新资源可查

    政客们到底怎么看待/谈论AI安全? 一个不错的资源,可以看看你是否认同你选出的官员的观点

  • 动态X @florian_tramer

    Florian Tramer 加入 AI2050 研究员队列

    非常激动能成为这个优秀队列的一员! 我的实验室将开展研究,旨在理解、预判并缓解 AI 模型的攻击性能力。

  • 动态WIRED Security and AI

    特朗普将"人工智能"更名为"超级智能",AI 高管集体沉默通过忠诚测试

    特朗普签署行政令,要求联邦政府将"人工智能"改称"Super Intelligence",并期望私营部门跟进。在白宫午餐会上,Bezos、Huang、Amodei、Zuckerberg、Pichai、Brockman、Karp、Musk 等 AI 高管无一提出异议。作家 Jacob Weisberg 称这是典型的特朗普忠诚测试——通过者即失去骨气。

  • 动态Mistral AI

    Mistral AI 与 SAP、Helsing 达成合作,推进德国与欧洲 AI 主权

    Mistral AI 宣布与 SAP 建立多年合作,为德国和欧洲提供完全主权的 AI 技术栈,将其模型集成进 SAP 的 AI Foundation,并共同开发面向复杂行业与政府机构的解决方案。Mistral AI 同时与 Helsing 合作,加速面向真实防务与安全应用的视觉-语言-动作模型开发。公司还将在未来数月内在德国开设办公室并大幅扩充本地团队。

  • 动态Tech Policy Press

    俄罗斯首部大模型法生效:以管控优先于能力建设

    俄罗斯首部针对大型基础模型的综合性法律于9月1日生效,该法7月26日由普京签署,核心是为符合条件的大模型开发者建立支持与管控框架,而非管理 AI 风险。法律设主权与国产两种地位,要求开发者须为俄罗斯法人、用户查询的生成与存储须在俄境内数据中心完成,并接受符合俄法律及传统价值观的评估,但评估程序与授予规则尚待政府决议确定。获得地位者可得到国家支持、参与政策制定并进入受保护市场,政府还可指定只能使用这两类模型的应用场景。法律将重要实施细节留给后续政府规则,包括国防、国家安全、反恐和公共管理等领域的模型使用规则,未规定禁止条款、人权影响评估或独立监督。版权方面,2027年3月起,为训练主权或国产大模型而在计算机内存中临时复制作品不构成侵权,该例外与模型法律地位绑定。