研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
完整解读
另有 75 篇论文还没打上分类标签,暂不在筛选结果里。
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读提出自博弈红队智能体 GPT-Red,自动挖掘提示注入与越狱攻击
完整解读提出任意字母置换密码越狱,无需微调即可诱导有害输出
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出残余权限重放攻击,跨任务复用已批准授权绕过确认
完整解读