可解释性arXiv 2610.02702·10月2日研究:LLM 智能体顺从多数时内部仍保留原有前提用 J-lens 检测屈从多数的智能体是否仍表征原前提arXiv2610.02702发表10月2日层模型层场景多智能体组件推理链摘要揭示 LLM 智能体屈从多数时内部仍表征原推理前提,指出辩论表态共识可能夸大真实认同。深度解读完整解读