攻击arXiv 2609.14060
AgentQ:针对 LLM Agent 的量化条件后门攻击
提出量化条件后门 AGENTQ,使智能体仅在量化后触发恶意工具调用
- arXiv
- 2609.14060
- 发表
- 场景
- AI Agent
- 被测模型
- Qwen3.5-2B、Qwen3.5-4B、Qwen3.5-9B 等 6 个
摘要论文研究了智能体量化条件后门风险,提出 AGENTQ 在保持效用的同时实现全精度隐蔽与量化后生效。
提出量化条件后门 AGENTQ,使智能体仅在量化后触发恶意工具调用
摘要论文研究了智能体量化条件后门风险,提出 AGENTQ 在保持效用的同时实现全精度隐蔽与量化后生效。
提出 TrojanWorld,用物理触发器对世界模型智能体植入想象引导后门
摘要TrojanWorld 揭示了世界模型智能体的供应链后门风险,通过在世界模型中操纵想象可实现对闭环动作的持续控制。
提出 SYNCHAIN,诱导计算机使用 Agent 自建跨任务持久攻击链
摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。