论文提出 eTAMP 攻击:网页内容注入可跨会话污染 Web Agent 记忆
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
提出流匹配逆向框架,从多向量视觉文档索引重构页面
本文针对多向量视觉文档检索器的索引安全性展开研究,证明了仅凭第三方向量库中存储的多向量索引,在零侧信息下即可逆向恢复出包含清晰文字和排版的原始文档图像。
用StegoMemory测试智能体持久记忆作为跨会话隐写信道的可行性
提出跨通道分段攻击,借MCP多通道隐式信任外发敏感数据
提出ReGap,用自生成伪监督微调恢复模型中的隐私关联
揭示拆分训练返回梯度以零支撑暴露诱饵行并泄露训练内容
这是一项关于双节点大语言模型拆分训练系统的系统安全案例研究,揭示了评估工具遗漏反向信道所导致的静默隐私失效。
提出Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私
提出PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出用扰动蒸馏本地代理并离线过滤来提取黑盒模型凭据
提出主题锚点投毒,放大众包微调后的专有指令提取