防御arXiv 2609.10707
面向 AI-SOC 的神经符号防御框架:用 SIEM 解码器与 NeMo Guardrails 阻断日志投毒提示注入
提出神经符号纵深架构,阻断 AI-SOC 的日志投毒与间接提示注入
- arXiv
- 2609.10707
- 发表
- 层
- 应用层
- 场景
- LLM 应用
- 测试
- Gemma 3 (12B)
提出神经符号纵深架构,阻断 AI-SOC 的日志投毒与间接提示注入
提出技能级联攻击,将恶意目标分散于多个技能以绕过单技能检测
摘要论文探讨了多技能智能体系统面临的技能级联攻击风险,提出自动化红队框架与基准集,指出跨技能交互存在安全防护盲区。
提出 SkillDRE,用预执行与运行时反馈演化恶意技能