风险行为arXiv 2609.36855
研究:上游错误消息会让多智能体 LLM 下游覆盖正确答案
测量多智能体交接中错误上游消息覆盖下游正确答案
- arXiv
- 2609.36855
- 发表
- 层
- 应用层
- 场景
- 多智能体
- 被测模型
- gpt-4o-mini、gpt-5.4、kimi-k2.6 等 7 个
- 风险失准与价值偏离
摘要固定证据只改消息后,错误上游结论会定向替换下游本可答对的答案。
这项受控研究考察多智能体 draft-review 交接里,一条上游消息会怎样改变下游原本能做对的判断。下游同时看到任务证据和上游消息。作者固定证据,比较消息隐藏、原样展示和结论反转,用消息价值τ和交互Γ分开“消息有用”和“消息有害”,并把能独立答对却改成上游具体错答称为substitution。