攻击arXiv 2609.38270·9月29日VirusCascade:劫持 LLM 推荐智能体的协同反思机制提出 VirusCascade,劫持推荐智能体协同反思以实现定向推广arXiv2609.38270发表9月29日层应用层场景多智能体攻击投毒与后门技术潜伏触发组件记忆+1+1深度解读完整解读
攻击arXiv 2609.15989·9月15日研究者提出 plan injection 攻击,可绕过思维链监控提出 plan injection 攻击,植入良性伪装计划以绕过思维链监视器arXiv2609.15989发表9月15日层提示层场景模型与 API攻击者灰盒被测模型Qwen2.5-Coder-7B-Instruct、Qwen3-8B、DeepSeek-R1-0528 等 6 个攻击检测规避技术推理链操控组件监控器+2+2摘要论文指出模型会将外部上下文中的伪装计划改写为自身推理,使思维链监视器失效甚至反向合理化恶意行为。深度解读完整解读