防御arXiv 2610.06966
APEX:在 LLM Agent 执行边界主动防御间接提示注入
提出 APEX,在执行边界以授权契约拦截智能体间接提示注入
- arXiv
- 2610.06966
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- GLM-5.2、DeepSeek-V4-Flash、GPT-5.6-sol 等 4 个
提出 APEX,在执行边界以授权契约拦截智能体间接提示注入
提出 STAR-Guard 双层防御缓解长程智能体遗忘安全约束
摘要揭示 GHOST 跨轮约束遗忘风险,构建 SCARBench 基准并通过 STAR-Guard 双层防御消除违规。
提出多层监控网关 ClawSentry,拦截恶意技能供应链与上下文注入
ClawSentry 是挂在智能体运行时之外的安全监督网关,用来同时盖住 skill 执行的多个生命周期边界,并把已被拒绝的效果记到会话里。
提出可安装护栏技能 SkillSonar,在运行时分流技能增强 Agent 的敏感动作
证明保留词元表示放大模板注入并验证分词缓解
摘要对话模板注入的权威性主要来自保留词元的学得向量而非文本语法,推理具有补偿作用,现有分词防御遗留工具协议漏洞。