防御arXiv 2609.14079
SkillSecurer:检测并修补 AI Agent 技能中的提示注入漏洞
提出 SkillSecurer,检测定位并修补智能体技能中的提示注入
- arXiv
- 2609.14079
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 测试
- Claude Sonnet 5、Gemini 3.6 Flash、GPT-5.6 Sol 等 10 个
提出 SkillSecurer,检测定位并修补智能体技能中的提示注入
提出 MOMAT 多图集检索与轻量判定,防御量化模型越狱
提出爆炸提示词,用条件触发的间接注入延迟诱发恶意工具调用
论文针对大语言模型智能体面临的间接提示注入威胁,研究了利用条件句式实现时间分离的爆炸提示词。