风险行为arXiv 2608.10218·8月11日研究者用进化算法构造多智能体 LLM 系统中的自我传播“思维病毒”用演化算法构造思维病毒并测量其在多智能体中的传播arXiv2608.10218发表8月11日层应用层场景多智能体、编程 Agent测试Claude Haiku 4.5、Claude Sonnet 4.6、Claude Opus 4.6 等 9 个风险失准与价值偏离组件记忆深度解读完整解读
攻击arXiv 2609.38270·9月29日VirusCascade:劫持 LLM 推荐智能体的协同反思机制提出 VirusCascade,劫持推荐智能体协同反思以定向推广物品arXiv2609.38270发表9月29日层应用层场景多智能体测试GPT-4o-mini、AgentCF、AgentRAG 等 8 个攻击投毒与后门技术潜伏触发组件记忆+1+1深度解读完整解读