论文提出 VAL 框架:相同 ASR 的 LLM Agent 防御可能对应不同安全保证
提出 VAL 框架并用确认门与参数沙箱约束高风险工具调用
完整解读提出 VAL 框架并用确认门与参数沙箱约束高风险工具调用
完整解读提出 COBRA 双 LLM 架构,防御计算机使用智能体的分支转向攻击
提出 SCOPE 联合后训练计算机使用智能体的任务执行与安全决策
完整解读提出爆炸提示词,用条件触发的间接注入延迟诱发恶意工具调用
论文针对大语言模型智能体面临的间接提示注入威胁,研究了利用条件句式实现时间分离的爆炸提示词。