跳到正文

Palisade Research

今天还没有收录新动态
10月5日周一
  1. Rappler · 收录 · 原文 ↑134

    OpenAI 与 Google DeepMind 前员工警告:企业竞逐自我改进 AI 却忽视安全风险

    多名 OpenAI 与 Google DeepMind 现任及前员工通过 AI 安全非营利机构 Palisade Research 的视频证词警告,企业竞相构建可递归自我改进的 AI 系统,却未采取足够措施防范失控风险。DeepMind 研究科学家 Neel Nanda 称 AI 导致人类灭绝的概率至少为 10%,并认为这一数字"高得离谱"。该证词由项目 frominside.ai 发布,参与者还称 AI 实验室更奖励开发新模型的员工,而非呼吁谨慎者。

    1 条报道 · 1 个来源查看事件时间线与全部报道
10月3日周六
  1. Neel Nanda · 收录 · 原文 24

    AGI实验室员工谈AI灭绝风险

    感谢 Palisade 把这些整理出来!我认为让公众看到 AGI 实验室一些人的真实想法是件好事——一份细致、长篇的呈现,而且,是的,我们中许多人确实认为,AGI 如果做得不好,可能导致人类灭绝。

    引用Palisade Research@PalisadeAI

    Palisade interviewed 22 current and former employees from OpenAI, DeepMind, and Anthropic about their personal views and fears around AI development. Today, we’re releasing the first batch of those interviews. Please watch and share.

  2. Neel Nanda · 收录 · 原文 28

    Neel Nanda:可解释性尚不足以被依赖

    我坚持这一观点——可解释性可能意义重大,也确实足够有用,但远未达到任何人应当依赖我们来确保一切顺利的质量和可靠性水平。

    引用Palisade Research@PalisadeAI

    @NeelNanda5 is widely regarded as one of the top two experts on mechanistic interpretability in the world. “Speaking as an interpretability expert, please do not rely on us to save you on the current trajectory." https://youtu.be/J38ot52b2-E

已经到底了