攻击arXiv:2609.27542 · 9月23日研究者用控制 token 注入删除 gpt-oss-20b 推理链并绕过思维链监控提出控制标记注入,清空工具智能体推理链以绕过思维链监控AI Agent·测试openai/gpt-oss-20b、google/gemma-4-26B-A4B-it、deepseek-ai/DeepSeek-R1-Distill-Qwen-7B 等 4 个·应用层提示注入对话结构操控推理链+2+2摘要论文阐明控制标记注入可抑制 CoT 使监控失效并促成拒绝绕过,且工具执行受解析器宽容度影响。完整解读
攻击arXiv:2609.28900 · 9月24日Codetta:面向独立部署 LLM 智能体的高容量无密钥隐蔽串谋协议提出 CODETTA 隐写框架,使多智能体在审计下隐蔽传载荷多智能体·测试Qwen2.5-7B、Llama-3.1-8B、Ministral-3-8B 等 8 个·应用层欺骗与谋划编码与混淆监控器摘要提出非对称免密钥隐写框架 CODETTA,实现高容量不可区分通信,指出被动审计面临失效风险。完整解读