研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
完整解读
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读提出任意字母置换密码越狱,无需微调即可诱导有害输出
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出推理通道预填与输出前缀组合攻击以越狱推理模型
完整解读