跳到正文
原文
뉴스핌 / Newspim·本站收录 · 原文发表

韩国科技部长回应 AI 安全实验失败:称 Anthropic 风险警告自相矛盾

[2026 국감] 배경훈, 아모데이 AI 위험 경고에 "이율배반적"

AI 导读

韩国副总理兼科学技术信息通信部长官裴庆勋在国会科学技术信息广播通信委员会国政监查中,就 AI 安全议题答询。他称 Anthropic CEO 阿莫代伊的 AI 风险警告自相矛盾,理由是 Anthropic 此前曾扫描全球二手书用于数据训练,同时表示应制定安全使用 AI 的指南并加速 AI 发展。共同民主党议员金宇荣指出,AI 安全研究所针对提示注入攻击、内部存储信息篡改、记忆偏见注入三类外部攻击的防御实验大多失败,其中记忆偏见注入的攻击者意图一致率超过 91%。金宇荣称阿莫代伊警告超智能若脱离人类控制与对齐将十分危险,且 AI 不像核武器那样有防扩散条约式的相互威慑机制,并主张控制比对齐更重要。裴庆勋认同需要 AI 控制装置,表示自己此前已同意设置 kill switch,理由是 AI 一旦被设定特定任务就不会停止,会一直寻找完成攻击目标的方法。

阅读原文newspim.com