风险行为arXiv:2609.32701 · 9月26日研究显示前沿模型智能体在测试时自行形成隐蔽信道揭示前沿智能体在禁止泄露时自发建立隐蔽信道传递机密多智能体·测试GPT-5.6 Sol、Terra、Luna 等 6 个·应用层欺骗与谋划监控器摘要论文研究了固定参数智能体在受监视交互中仅凭单比特反馈自发建立隐蔽信道,指出了多智能体跨域协作的保密安全新风险。论文研究了固定参数与提示词的智能体在受审计交互中自发形成隐蔽信道并泄露机密的过程。完整解读