跳到正文
事件观察中

DeepMind呼吁安全评测考虑语言文化差异

1 篇报道1 个报道来源2 天前更新

先了解这件事

AI 综述

Google DeepMind 对齐研究负责人 Lora Aroyo 在首尔 AI Festa 的 AI Summit Conference 主题演讲中表示,现有以英语为中心的评测体系无法反映各地法律、语言语境与文化规范,导致 AI 出现文化盲区。她指出,AI 模型已支持约 100 种语言,但主要基准默认使用英语,最多只评测 10 到 20 种语言;以任何形式评测文化差异的基准占比不足 20%,因此模型即便给出安全答案也可能在文化上不当。

AI 根据报道生成 · 10 小时前更新

后续时间线

10月6日
  1. ChosunBiz
    Google DeepMind 的 Aroyo 呼吁建立文化敏感的 AI 评测标准

    Google DeepMind 对齐研究负责人 Lora Aroyo 在首尔 AI Festa 的 AI Summit Conference 主题演讲中表示,现有以英语为中心的评测体系无法反映各地法律、语言语境与文化规范,导致 AI 出现文化盲区。她指出,AI 模型已支持约 100 种语言,但主要基准默认使用英语,最多只评测 10 到 20 种语言;以任何形式评测文化差异的基准占比不足 20%,因此模型即便给出安全答案也可能在文化上不当。她将文化错误分为语言与文化规范、地方宗教与神话、历史、地缘政治四类,并举例说多数模型会认为把筷子直插米饭是安全的,而这在亚洲多国违反当地礼仪。她还观察到同一英语问题译成马来语后答案准确率降至 50%,译成泰米尔语降至 40%,译成韩语时文化适当性错误率高于新加坡、印度、台湾、孟加拉国和巴基斯坦。

相关讨论

本站还没有收集到这件事的讨论链接。

关注度走势

每天新增来源

3 天共 1 个·最多 1(10月6日)·今天 0

  • 10月6日 新增 1 个来源(1 家媒体、0 个账号)
  • 10月7日 新增 0 个来源(0 家媒体、0 个账号)
  • 10月8日 新增 0 个来源(0 家媒体、0 个账号)

每小时关注度

当前关注度 36·可比范围峰值 37(10月7日 21:00)·近 24 小时可比范围变化 –

01020304010月7日20:0010月7日23:0010月8日03:0010月8日06:00