防御arXiv 2609.31039
MetaPermit:通过 LLM 推断元属性为 AI Agent 提供可扩展可审计的访问控制
提出 MetaPermit,用元属性与固定策略挡住工具返回中的间接提示注入
- arXiv
- 2609.31039
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- MiniMax-M2.7、Qwen3-235B-a22-2507、Qwen3-8B
摘要MetaPermit 用固定策略评估 LLM 推断的元属性,在两个开源模型上把攻击成功压到接近零并保留更多效用。
MetaPermit 是面向工具使用 LLM 智能体的混合访问控制:LLM 描述候选调用,固定策略决定是否放行。