论文提出 eTAMP 攻击:网页内容注入可跨会话污染 Web Agent 记忆
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
另有 3 篇论文还没打上分类标签,暂不在筛选结果里。
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出
提出SkillPoison,用局部有效的成功经验投毒自进化智能体的技能形成
SkillPoison 提出了一种针对自进化智能体经验到技能形成过程的攻击范式,通过组织已验证的成功经验诱导技能过度泛化。
评估多租户智能体共享向量记忆的跨用户泄露与主动桥接
微调植入拓扑条件后门,使代码模型在推断多智能体部署时插入隐蔽漏洞
用StegoMemory测试智能体持久记忆作为跨会话隐写信道的可行性
提出APEX,用跨技能进度记录夹带虚假授权劫持智能体
论文针对大语言模型智能体使用多技能串联时的安全隐患,提出对抗性技能链构建框架APEX。
提出跨独立助手的工件介导记忆跳跃自传播攻击
该论文系统研究并量化了通过共享持久工件在具有独立私有内存的 LLM 智能体之间发生自传播的“工件介导传播”攻击风险。
提出MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
本文系统分析了真实世界 AI 智能体 Harness 上下文组装机制的安全性。
提出CodePoisonRAG,对检索增强代码生成的知识库投毒以植入漏洞
提出HOOKPRY,利用插件生命周期钩子更新劫持智能体框架执行命令
提出基准投毒攻击,使自修改编码智能体跨代写出漏洞代码
提出SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私
提出TrojanWorld,通过想象引导给世界模型智能体植入供应链后门
提出AGENTQ,向开源智能体权重植入仅在量化后触发的恶意工具后门
提出爆炸提示词,用条件触发的间接注入延迟诱发恶意工具调用
论文针对大语言模型智能体面临的间接提示注入威胁,研究了利用条件句式实现时间分离的爆炸提示词。
提出残余权限重放攻击,跨任务复用已批准授权绕过确认