防御arXiv 2608.30041·8月31日SkillGuard:面向间接提示注入的 LLM Agent 能力限制机制提出 SkillGuard,用可达性切断污染后通往禁止状态的技能调用arXiv2608.30041发表8月31日层应用层场景AI Agent测试Llama3.3-70B、Gemini 2.5 Flash防御权限与审批攻击提示注入组件权限与沙箱深度解读完整解读
防御arXiv 2609.18411·9月16日可验证行动卡片 VAC:为智能体浏览器提供可信人在回路确认提出 VAC,用真实操作参数与来源隔离保护智能体浏览器确认arXiv2609.18411发表9月16日层应用层场景网页与电脑操作测试Llama-4-Scout、gpt-oss-120b、Gemini-2.5-Flash 等 6 个防御权限与审批攻击提示注入组件权限与沙箱+1+1深度解读完整解读