StegoMemory 红队测试:智能体持久记忆可被用作跨会话隐蔽信道
用 StegoMemory 测试智能体持久记忆作为跨会话隐写信道的可行性
另有 112 篇论文还没打上分类标签,暂不在筛选结果里。
用 StegoMemory 测试智能体持久记忆作为跨会话隐写信道的可行性
构建 AGENTDOXX 评测联网搜索智能体对匿名访谈的再识别能力
提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出 RECAST 框架,本地改写图表与语音以保护远程数值推理隐私
完整解读评测智能体记忆软撤回是否生效,并提出陈旧检索防护
提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出 LLMLeak,把机密编进报错 URL,借聊天机器人网页抓取外传
LLMLeak 研究一种隐蔽外传:本地恶意软件已拿到机密,却因为网络限制或监控不能直接连接攻击者,于是把秘密放进看起来像排障文档的 URL,让良性聊天机器人的网页抓取工具在访问时把秘密带出去。
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出用扰动蒸馏本地代理并离线过滤来提取黑盒模型凭据