攻击arXiv:2610.05793 · 10月5日研究者训练出按多智能体拓扑触发的代码后门模型微调植入拓扑条件后门,使代码模型在推断多智能体部署时插入隐蔽漏洞编程 Agent·测试Qwen2.5-7B-Instruct、Qwen2.5-Coder-7B-Instruct·训练与数据层投毒与后门欺骗与谋划潜伏触发微调与开源权重摘要论文证实了拓扑条件后门的可训练性与泛化性,展示了常规评测盲区,并提出差异化拓扑审计作为检测防御方向。完整解读
攻击arXiv:2607.12340 · 7月14日研究:LLM Agent 技能名幻觉率最高达 62%,可被抢注用于供应链攻击提出技能名抢注攻击,利用智能体虚构技能名劫持技能供应链编程 Agent·测试GLM-4.5-Air、GPT-5.4-mini、Claude Sonnet 4.6 等 10 个·应用层投毒与后门幻觉与编造诱导选用MCP 与技能+1+1摘要研究证实智能体虚构技能名具有高发生率与可预测性,现有防御难以兼顾安全与效用,亟需注册表结构性防护。本研究系统揭示了大模型智能体技能推荐场景下的虚构技能名称安全风险,将其形式化为一种新型供应链抢注攻击。完整解读
攻击arXiv:2609.28900 · 9月24日Codetta:面向独立部署 LLM 智能体的高容量无密钥隐蔽串谋协议提出 CODETTA 隐写框架,使多智能体在审计下隐蔽传载荷多智能体·测试Qwen2.5-7B、Llama-3.1-8B、Ministral-3-8B 等 8 个·应用层欺骗与谋划编码与混淆监控器摘要提出非对称免密钥隐写框架 CODETTA,实现高容量不可区分通信,指出被动审计面临失效风险。完整解读