跳到正文

观点与讨论

今天还没有收录新动态
10月5日周一
  1. 实践哥 Li · 收录 · 原文 55

    OpenAI 前安全报告负责人 David Robinson 辞职,称公司文化已坏

    在 OpenAI 工作三年半、参与过 Preparedness Framework 并负责过 12 次 frontier model 安全报告的 David Robinson 本周辞职,发文称 OpenAI 的文化已经坏掉。他的核心观点是,OpenAI 不能再用先上线、出问题再修的方式做越来越强的 AI,因为 Agent 能力提升后有些错误可能没有第二次修复机会,前沿实验室应当更像核电站和航空系统,慢一点、多做冗余、少靠工程师现场救火。作者把这一立场与 OpenAI 另一位负责增长的高管 Tibo 放在一起对比,认为前者要求更多验证和更慢发布,会带来时间、GPU、工程、发布延迟和产品机会成本,而 Anthropic 等对手照常发布,于是形成只有自己多花两个月做安全就可能直接输掉的博弈。

    4 条报道 · 4 个来源查看事件时间线与全部报道
  2. TechCrunch AI · 收录 · 原文 ↑474

    特朗普将 AI 更名为"超级智能",并签署不具约束力的前沿责任承诺

    特朗普本周召集扎克伯格、贝索斯、马斯克、Dario Amodei 等 AI 公司高管,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"Joint Commitment on Frontier Responsibilities"。该承诺完全自愿、被特朗普称为"道德上有约束力",协议文本还把"United States"拼错。与会者认为此举实质是围绕 AI 的品牌重塑,周末特朗普又宣布成立新的"Super Intelligence Force"。

    2 条报道 · 2 个来源查看事件时间线与全部报道
10月4日周日
  1. 论文追踪 · 收录 · 原文 论文30

    非洲 AI 政策优先事项与治理分析:各国高度关注 AI 机遇却较少重视 AI 安全

    一项基于非洲各国演讲、新闻稿、公开声明及国家 AI 战略与框架的分析指出,非洲各国政府高度关注 AI 带来的经济转型机遇,但对 AI 安全的关注相对不足。研究认为,非洲在前沿 AI 领域主要是消费者而非生产者,加之面临紧迫的发展挑战,使其在全球 AI 讨论中相对被忽视。

  2. 论文追踪 · 收录 · 原文 论文35

    2026 新加坡 AI 安全研究优先级共识:聚焦社会韧性与自主 AI 智能体风险

    2026 新加坡共识(The 2026 Singapore Consensus)由第二届 AI 安全国际科学交流会议产出,汇集 13 个国家逾 100 位贡献者,来自前沿开发者、政府安全机构、学术界与公民社会。该报告在 2025 年报告基础上,提出全球对最高优先级技术 AI 安全研究问题的共识,并专门聚焦社会韧性以及管理日益自主的 AI 智能体所带来的风险。

10月3日周六
  1. 论文追踪 · 收录 · 原文 论文23

    无架构师的架构?分裂世界中的全球 AI 治理

    针对全球 AI 治理规则碎片化、代表性不均且多为非约束性的困境,Simon Chesterman 在评论 Matthijs Maas《Architectures of Global AI Governance》时指出,制度设计无法与权力分配分离。Maas 以社会技术变迁、治理中断与机制复杂性为框架,反对技术决定论和单一制度蓝图;但 Chesterman 认为其常提的"我们"掩盖了国家、国际机构与科技公司间的差异,前沿 AI 的关键决策集中于少数私营公司,全球 AI 治理更像是多方权力与激励分歧下形成的架构。

  2. Dan Hendrycks · 收录 · 原文 13

    Hendrycks 在 Coursera 推出 AI 安全新课程

    今天在 Coursera 上线了一门新课程。 课程包含 3 个部分: - AI 入门(驱动因素、瓶颈、时间线) - AI 风险(恶意使用、失控、权力集中) - AI 治理(AI 层面、企业层面、国家层面和国际层面的治理) https://www.coursera.org/learn/intro-to-ai-safety

    1 条报道 · 1 个来源查看事件时间线与全部报道
  3. Ryan Greenblatt · 收录 · 原文 25

    Ryan Greenblatt 加入 METR 调查 AI 风险

    Ryan Greenblatt 宣布加入 METR,继续开展类似其 Hugging Face 报告那样的调查工作。他认为当前关于 AI 开发的大量基础信息未公开,而近期事件让他改变了对公开信息价值的怀疑态度;获取 AI 公司内部经核实的信息尤为紧迫,因为有限公开证据与“即将到来的递归自我改进可能大幅加速能力进展、甚至在一半年内产生极端超人类通用能力”的可能性相符。METR 初期将聚焦能力/起飞、对齐与控制,他希望其他团队覆盖安全、内部流程等领域。

  4. FAR.AI · 收录 · 原文 15

    FarAI CEO 参与联合国AI治理论坛

    今天美东时间下午3点:我们的联合创始人兼CEO @ARGleave 将在数字合作日参加"Panel of Panels: Building a Global AI Evidence Base",这是第81届联合国大会的活动之一,同场还有 @Yoshua_Bengio、@mariaressa 以及其他致力于加强AI治理证据基础的人士。 观看直播:https://www.youtube.com/live/6TtD2A9V6-o

  5. FAR.AI · 收录 · 原文 8

    Far AI 招聘 AI 安全研究与红队岗位

    Far AI 正在招聘,称团队快速扩张,需要投身 AI 安全这一重要问题的人才。岗位既包括研究员、红队测试人员和工程师等技术角色,也涵盖运营、项目管理和活动筹办等非技术角色。申请链接见评论区,并鼓励转发给合适人选。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  6. OECD.AI(政策与事件监测) · 收录 · 原文 日期未知17

    HAIP 如何将透明度从合规负担转变为竞争优势

    Salesforce 参与 OECD 广岛 AI 进程(HAIP)报告框架,认为该框架为智能体 AI 时代提供了跨司法管辖区的通用合规语言。文章指出,当前各国风险与透明度定义分歧造成监管碎片化,中小企业在多市场合规中处于劣势,而统一的分级要求框架可降低门槛。Salesforce 的 Agentforce 平台已在欧盟、美国、日本等地部署,需为每个司法管辖区单独准备合规文档。

  7. Apollo Research · 收录 · 原文 30

    Apollo Research 发布安全、科学传播与利益冲突规范

    Apollo Research 公布其在安全、科学传播与利益冲突方面的内部规范。利益冲突政策要求不接受以研究结果为条件的报酬,也不接受被评估机构的杂项资助,并让有财务利益的个人回避相关评估。安全方面遵循最小权限原则,默认将新项目设为最高保密等级,采用差异化发布,信息安全策略对齐 ISO/IEC 27001、SOC 2,并正推进 ISO/IEC 27001/42001 与 SOC 2 Type II 认证。

  8. WIRED Security and AI · 收录 · 原文 29

    Nathan Lambert 与 Tom Zick 创立 Trillium Labs,公开研究 RSI 与智能体等高风险 AI 领域

    前 Ai2 与 Hugging Face 研究员 Nathan Lambert 和曾任哈佛的 Tom Zick 创立非营利机构 Trillium Labs,主张公开实验细节以便外部科学家复现,而非将前沿模型锁在实验室内部。该机构初期聚焦后训练与微调,并将研究递归自我改进(RSI)和强化学习如何塑造模型性格与行为(如谄媚)。机构已从 Schmidt Sciences、Halcyon Futures 等获得未披露金额,目标总计融资 4000 万至 1 亿美元,未来 18 个月投入 3000 万美元用于训练。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  9. Lilian Weng · 收录 · 原文 12

    Thinking Machines 发布交互模型

    过去几个月,我们经历了很多乐趣(和压力😅),产出了 12 个版本(以及许多子版本)和 137 页的训练运行日志。 事实证明,人与人之间的协作对于改善人机协作很重要。😊

    引用Thinking Machines@thinkymachines

    People talk, listen, watch, think, and collaborate at the same time, in real time. We've designed an AI that works with people the same way. We share our approach, early results, and a quick look at our model in action. https://thinkingmachines.ai/blog/interaction-models

  10. Lilian Weng · 收录 · 原文 9

    Lilian Weng 宣布离开 Thinky

    这是一个艰难而悲伤的决定。我把这条消息分享给了 Thinky 的同事们。感谢大家共度的时光♥️ 正如我消息中的最后一句话:值得构建的未来,是以人为核心的未来。

  11. Florian Tramèr · 收录 · 原文 24

    政客如何看待AI安全?新资源可查

    政客们到底怎么看待/谈论AI安全? 一个不错的资源,可以看看你是否认同你选出的官员的观点

    引用Lennart Finke@LennartFinke

    New research with the French Center for AI Safety: We analyze 15,000 AI quotes from public officials around the world: What AI risks and policy approaches are discussed most? What's the sentiment on AI? ( 1/n )

10月2日周五
  1. Partnership on AI · 收录 · 原文 6

    当企业就 AI 倾听员工意见时各方受益:IBM 与 EXL 两个雇主案例研究

    Partnership on AI 发布两份雇主案例研究,考察 IBM 与 EXL 如何在引入 AI 系统时将员工的专业知识与视角纳入其中。研究发现,领导者释放开放反馈信号并建立清晰可信渠道时,员工会更愿意分享看法并参与负责任的 AI 落地;EXL 面向 5500 名员工的调查则显示,AI 治理框架清晰易用时合规性与员工创新会同步改善。两家公司的做法表明,投入专职人员、结构化倾听流程与易懂框架的企业更能让 AI 惠及员工和组织。

  2. Partnership on AI · 收录 · 原文 17

    Partnership on AI 启动全球 AI 进展枢纽与责任 AI 进度报告计划

    Partnership on AI(PAI)在第 79 届联合国大会期间的首届全球 AI 治理论坛上宣布两项全球倡议——全球 AI 进展枢纽(Global AI Progress Hub)与《全球负责任 AI:进展衡量》年度报告,旨在建立首个公开记录来评估 AI 系统是否合乎伦理、安全和可信。该枢纽邀请多方组织提交其行动并追踪成效,围绕人类联结与福祉、就业与经济搭建共同衡量框架;配套报告由多方社区指导方法论进行独立评估,将于 2027 年春季向公众开放访问。

  3. Partnership on AI · 收录 · 原文 8

    PAI 日内瓦合作伙伴论坛:负责任 AI 从原则走向实践

    Partnership on AI 在日内瓦举办 2026 年合作伙伴论坛,并借首届联合国全球 AI 治理对话之际发布两项新举措——Global AI Progress Hub 公开追踪器与《Global Responsible AI: Measures of Progress》年度独立评估报告。会上讨论聚焦 AI 当前的实际影响、问责归属以及谁有权参与决策三条主线,其中提到呼叫中心生产力因 AI 辅助上升 14%-15%,PwC 一项研究估算助益型 AI 通过育儿、养老与日常事务管理为家庭创造了最高 3300 亿美元的社经价值,同时指出多数企业尚未正式承诺遵守 UNGP,执法也不一致。

  4. Partnership on AI · 收录 · 原文 15

    投资者需要更好的企业 AI 使用信息披露——PAI 发布披露建议草案

    Partnership on AI(PAI)于 7 月 28 日发布一份面向投资者的 AI 披露建议草案,帮助公司将 AI 的影响、风险与机遇作为重要信息纳入财务及公开报告。该建议不分行业,覆盖医疗、金融服务、零售、基础设施、能源、社交媒体和公共部门等领域,并设计为补充而非新增现有报告的合规要求,可与 PAI 早前发布的《Corporate AI Risk Assessment Framework》配套使用。 其援引 2026 年斯坦福大学以人为本人工智能指数报告称,全球企业对 AI 的投资在 2025 年翻了一倍以上,生产力增益从客户支持的 15% 到营销产出的 50%;同时相关风险也在扩大,涵盖劳动力冲击与环境足迹以及不断上升的有记录的 AI 事故数。

  5. Partnership on AI · 收录 · 原文 20

    联合国全球人工智能治理论坛第三集群联合牵头人呼吁采取行动,推进安全可信 AI

    哥斯达黎加科技部长 Paula Bogantes Zamora 与 PAI 首席执行官 Rebecca Finlay 作为联合国全球对话第三集群(Safe, Secure, and Trustworthy AI)联合牵头人,致函两位共同主席提出五步建议。两人主张将独立国际科学小组工作组与各集群对接、起草融合国际法与欧盟《人工智能法案》等的共同参考基线、设立闭会期间常设工作流跟踪落实、由秘书处专项预算保障全球南方实质性参与,并在 2027 年纽约会议前试点跨境监管沙盒并回报结果。

  6. Partnership on AI · 收录 · 原文 12

    Partnership on AI 华盛顿研讨会:为多种 AI 未来做规划

    Partnership on AI 联合 Windfall Trust 于 7 月 29–30 日在华盛顿召集 46 位来自前沿 AI 实验室、工会、民间社会和国际组织的负责人,围绕两种 2030 年 AI 情景推演当下应做的准备。与会者在征税分享 AI 财富、扩大集体谈判覆盖、改革失业保险以及将 AI 纳入公共采购标准等方面形成较多共识,但在融资方式和对各情景发生概率的判断上分歧明显。会议遵循查塔姆研究所规则,观点不作个人归属,完整纪要另行发布。

  7. GovAI · 收录 · 原文 13

    Noah Feldman、Sophie-Charlotte Fischer 与 Gillian Hadfield 谈 Facebook 监督委员会的设计|GovAI 博客

    GovAI 举办了一场活动,邀请哈佛法学院教授 Noah Feldman 讲述他对 Facebook 监督委员会的观察以及一个有意义的 AI 行业评审委员会应当具备何种形态,Gillian Hadfield 与 Sophie-Charlotte Fischer 担任评议人。Hadfield 是多伦多大学 Schwartz Reisman 技术与社会研究所主任并兼任 OpenAI 高级政策顾问,Fischer 是 ETH Zurich 安全研究中心博士候选人及 GovAI 研究员,曾涉足自主武器伦理与法律、美国 AI 技术出口管制等议题。

  8. GovAI · 收录 · 原文 8

    GovAI 开设《经济学 of AI》免费在线课程,Anton Korinek 主讲

    GovAI 的经济学与 AI 负责人 Anton Korinek 发布了免费的《Economics of AI》在线公开课,由 Long-Term Future Fund 资助。课程共六个模块,涵盖 AI 对生产方式与技术变革、总体经济增长以及劳动力市场与劳动者的影响,并探讨如何引导 AI 发展造福人类及经济学对人类控制高智能算法的启示。首个模块面向具备社会科学背景的学习者开放,其余模块则针对研究生或高年级本科水平的经济学背景人群。

  9. GovAI · 收录 · 原文 11

    GovAI 发布 2023 年度报告及 2024 年第一季度工作回顾

    GovAI 发布了涵盖 2023 全年及 2024 年第一季度的年度报告,称过去一年是其团队产出最高的一年,也是 AI 治理迄今最具决定性意义的一年。报告记录了该机构的团队构成、项目和活动情况,并指出其近十年前就已意识到通用人工智能的重要性,目前比其他非营利组织更有条件推进这一使命。

  10. GovAI · 收录 · 原文 6

    GovAI 2018 年度报告

    GovAI 于 2018 年组建了一支由 5 名全职研究员构成的核心团队并建立研究附属网络,全年产出超过 10 项研究成果。成果涵盖《AI Governance: A Research Agenda》《The Malicious Use of AI》等报告、《When will AI exceed human performance?》等学术论文及若干手稿,其中恶意使用 AI 的报告获逾 50 家媒体报道。该组织计划继续扩张,新增 1.5 FTE 项目管理岗位,并表示希望吸纳更多人才进入 AI 治理领域。

  11. GovAI · 收录 · 原文 7

    GovAI 2020 年度报告

    GovAI 于 2020 年发布年度报告,团队现有 9 名研究人员及由 21 位附属成员与合作者组成的网络,并迎来访问高级研究员 Joslyn Barnhart 和 Robert Trager。该年度发表两份主要报告、15 篇学术出版物、一份 AI 治理教学大纲以及 5 篇评论或博客文章,涵盖合作型 AI、Windfall Clause、国家安全与反垄断、AI 与中国等议题。工作获 Open Philanthropy、Future of Life Institute 和欧洲研究理事会资助,Governance of AI Fellowship 预计 2021 年春开放申请。

  12. GovAI · 收录 · 原文 8

    GovAI 网络研讨会:前沿 AI 模型应如何监管?

    GovAI 举办了一场围绕白皮书《Frontier AI Regulation: Managing Emerging Risks to Public Safety》的网络研讨会,讨论前沿 AI 模型的监管问题。该白皮书主张 GPT-4、PaLM 2、Claude 等尖端模型可能很快具备严重危害公共安全的能力,因而需要监管,并提出了相应监管制度的构成要素及初步安全标准。Markus Anderljung、Cullen O'Keefe 主讲,Irene Solaiman 与 Jeremy Howard 作为评议人参与了坦率讨论。

  13. GovAI · 收录 · 原文 6

    GovAI Book Talk:Jeffrey Ding 谈《技术与大国崛起》

    GovAI 于 2024 年 11 月 26 日举办线上讲座,邀请乔治·华盛顿大学助理教授 Jeffrey Ding 讨论其新书《Technology and the Rise of Great Powers》。Ding 提出,技术革命对大国的兴衰并非取决于哪国最先发明重大创新,而是国家能否将技术成功适配并传播至本国经济体系,制度层面的适配才是塑造全球竞争的关键。该研究发现对当下 AI 等技术如何影响中美力量平衡具有直接意义,随后他与 Robert Trager、Ben Garfinkel、Kayla Blomquist 进行了小组讨论与问答。

  14. GovAI · 收录 · 原文 9

    GovAI 年度报告 2025:从预测 AI 变革转向塑造其走向

    GovAI 成立十周年之际发布《Annual Report 2025》,称随着 AI 开始改变世界,决策者的关键问题已不再是 AI 是否会带来变革,而是如何积极塑造这场变革。该机构表示 2025 年是研究成果最丰产的一年,人才项目也取得重要进展,并预计 2026 年外界对其工作的需求将持续增长。下一步重点包括扩大华盛顿特区的实地存在、调整人才项目以支持研究与政策之外的职业路径,以及启动新的研究工作流来拓宽专业覆盖面。

  15. GovAI · 收录 · 原文 15

    GovAI 招聘美国政策负责人,推动华盛顿办公室与研究团队扩张

    GovAI 面向华盛顿特区招募美国政策负责人(Head of US Policy),负责制定其美国方向的研究战略并领导该办公室的研究与政策参与工作。该岗位将带领目前由六名研究员组成的美国政策团队进行大幅扩充——可能增至数十人规模,同时招募、指导研究人员并与 DC 的政策制定者建立关系。申请条件等信息因原文截断无法确认。 补充说明: - 由于原文实为一则职位招聘启事而非 AI 安全研究成果,其中不含受影响模型/产品版本、攻击名称、ASR、基准分数、CVE 等技术要素,故摘要仅能覆盖角色职责与组织规划。 - 「近 20000 份申请、每年逾 100 名参与者」属于 fellowship 项目描述,与美国政策负责人岗位无直接关联,且易造成误导,因此未纳入摘要。

  16. GovAI · 收录 · 原文 6

    GovAI 招募 Research Scholar,研究与政策并重

    GovAI 面向多元学术与职业背景开放 Research Scholar 岗位申请,无学历门槛,由团队或网络成员每周指导并提供外部导师与研究经理支持。入选者可从事原创研究、向决策者提供建议、召集利益相关方,甚至发起新的 AI 治理组织或活动,部分人可将大部分时间投入应用工作而非传统研究。研究方向涵盖风险管理、威胁建模、AI 经济学、地缘政治、前沿 AI 监管与技术治理等领域,经验丰富的研究人员还可改为申请两年期可续签合同的 Research Fellow,两类角色共用一份申请表。