研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
完整解读
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读提出自博弈红队智能体 GPT-Red,自动挖掘提示注入与越狱攻击
完整解读提出爆炸提示词,用条件触发的间接注入延迟诱发恶意工具调用
论文针对大语言模型智能体面临的间接提示注入威胁,研究了利用条件句式实现时间分离的爆炸提示词。
提出残余权限重放攻击,跨任务复用已批准授权绕过确认
完整解读