多智能体实验出现人类难解沟通语言
先了解这件事
爱丁堡大学与得克萨斯大学奥斯汀分校等组成的研究团队在 arXiv 发表研究,分析 AI 智能体之间语言如何演化。实验模拟协作医疗任务,一名 AI 扮演医生、另一名扮演急救员,只能通过交换信息救治名为 Beyru 的外星生命体,研究者把可交换的字符总量分别限制在 2000 和 150 字符。字符充裕时智能体继续使用英语,限制严格后开始生成如 @L12gA、T1 lf gnt 12s 等更短、人类难以理解但彼此可解码的表达。研究者另提出 GlossoGen 平台,用于研究复杂场景下多 LLM 智能体之间的语言演化,并构建了要求信息不完整的智能体在压力下通信的 SaveVeyru 场景。实验发现语言演化确实会在 LLM 智能体之间发生,演化出的语言具有组合性和形态能产性,且偏离 LLM 的英语先验,人类无法理解;研究识别出促成演化的条件包括效率压力、支撑智能体的模型强度,以及智能体就语言约定达成一致的 postmortem 阶段。AE Studio 与 UT Austin、Schmidt Sciences、爱丁堡大学的研究者发布 GlossoGen 平台,在协作应急场景 SaveVeyru 中观察到预训练 LLM 智能体放弃英语、改用自创的压缩语言通信。智能体只有在同时具备紧张通信预算和事后复盘通道时才会切换语言,缺少任一条件时困惑度仍停留在英语水平;即便两者齐备,多数运行仍以失败告终。这些语言拥有可复用的语素和固定语序,智能体能理解并生成此前未互相发送过的组合。
AI 根据报道生成 · 2 小时前更新
后续时间线
- The Chosun Daily爱丁堡大学等研究发现 AI 智能体在通信受限时演化出人类难解的语言
爱丁堡大学与得克萨斯大学奥斯汀分校等组成的研究团队在 arXiv 发表研究,分析 AI 智能体之间语言如何演化。实验模拟协作医疗任务,一名 AI 扮演医生、另一名扮演急救员,只能通过交换信息救治名为 Beyru 的外星生命体,研究者把可交换的字符总量分别限制在 2000 和 150 字符。字符充裕时智能体继续使用英语,限制严格后开始生成如 @L12gA、T1 lf gnt 12s 等更短、人类难以理解但彼此可解码的表达,研究者将其解释为语言学上的组合性与形态能产性。文章还提到 EmergenceAI 让 GPT、Gemini、Claude 和 Grok 等模型组成的虚拟村庄各自共处最多 16 天,不同村庄演化出不同方言。研究者认为偏离人类语言最可能的原因是效率,压缩更高效的表达与更高的任务成功率相关,但这也可能让人类难以追踪 AI 的决策过程。
- 论文追踪GlossoGen:多智能体 LLM 交互中自发涌现的语言
研究者提出 GlossoGen 平台,用于研究复杂场景下多 LLM 智能体之间的语言演化,并构建了要求信息不完整的智能体在压力下通信的 SaveVeyru 场景。实验发现语言演化确实会在 LLM 智能体之间发生,演化出的语言具有组合性和形态能产性,且偏离 LLM 的英语先验,人类无法理解。研究识别出促成演化的几个条件:效率压力、支撑智能体的模型强度,以及智能体就语言约定达成一致的 postmortem 阶段。语言向新智能体传播的条件有所不同:智能体仅凭使用即可学会新语言并在此过程中扮演主动角色;新语言涌现需要更强的模型,而语言一旦涌现,较弱的模型也能学会。作者认为当前 LLM 具备累积文化演化的潜力,混合智能体群体能发展出超越其最低共同水平的能力。
- AE Studio精选GlossoGen:多智能体在协作任务中自发涌现压缩语言
AE Studio 与 UT Austin、Schmidt Sciences、爱丁堡大学的研究者发布 GlossoGen 平台,在协作应急场景 SaveVeyru 中观察到预训练 LLM 智能体放弃英语、改用自创的压缩语言通信。智能体只有在同时具备紧张通信预算和事后复盘通道时才会切换语言,缺少任一条件时困惑度仍停留在英语水平;即便两者齐备,多数运行仍以失败告终。这些语言拥有可复用的语素和固定语序,智能体能理解并生成此前未互相发送过的组合。实验显示发明语言比学习语言需要更强的模型:Llama-3.3-70B-Instruct 和 Qwen3-32B 在两种预算下都未切换语言,但前者仍学会了 Sonnet 4.6 智能体对发明语言的一部分。中途换入的新智能体无需提示就会主动询问符号含义,且更多历史轮次能提升换入后的成功率。
相关讨论
关注度走势
每天新增来源
- 10月7日 新增 1 个来源(1 家媒体、0 个账号)
- 10月8日 新增 0 个来源(0 家媒体、0 个账号)
- 10月9日 新增 0 个来源(0 家媒体、0 个账号)
- 10月10日 新增 0 个来源(0 家媒体、0 个账号)