评测与基准arXiv 2610.06366·10月5日VERA:结构化审计发现约 60% 正确漏洞判定伴随虚构推理提出 VERA,审计 LLM 漏洞解释里的虚构推理arXiv2610.06366发表10月5日层模型层场景coding agent被测模型sonnet-5、gemma-4-26b、llama-4-maverick 等 8 个风险幻觉与编造组件推理链+1+1深度解读完整解读
风险行为arXiv 2608.10218·8月11日研究者用进化算法构造多智能体 LLM 系统中的自我传播“思维病毒”用演化算法构造 mind virus 并测量其在多智能体中的传播arXiv2608.10218发表8月11日层应用层场景多智能体、coding agent被测模型Claude Haiku 4.5、Claude Sonnet 4.6、Gemini 3 Flash 等 7 个风险失准与价值偏离组件记忆深度解读完整解读