论文提出 eTAMP 攻击:网页内容注入可跨会话污染 Web Agent 记忆
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
另有 3 篇论文还没打上分类标签,暂不在筛选结果里。
提出eTAMP,通过网页注入跨会话污染Web智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
提出WebMirage,用对抗图像劫持视觉网页智能体的浏览器操作
WebMirage 是一个面向视觉定位网络智能体的流水线感知端到端红队攻击框架。
提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出
提出SkillPoison,用局部有效的成功经验投毒自进化智能体的技能形成
SkillPoison 提出了一种针对自进化智能体经验到技能形成过程的攻击范式,通过组织已验证的成功经验诱导技能过度泛化。
微调植入拓扑条件后门,使代码模型在推断多智能体部署时插入隐蔽漏洞
用StegoMemory测试智能体持久记忆作为跨会话隐写信道的可行性
提出跨通道分段攻击,借MCP多通道隐式信任外发敏感数据
提出TrustProbe,挖掘技能内容流向特权操作的信任链漏洞
提出PRETEXT,迭代改写技能文本以绕过扫描并执行木马行为
PRETEXT 是一项针对基于“静态规则加语义大模型”的智能体技能安全检测框架的白盒攻击与协同进化评估研究。
提出两阶段框架A2M,优化MCP工具元数据与返回载荷以劫持智能体
论文提出了一种针对模型上下文协议(MCP)智能体的两阶段黑盒劫持框架 A2M。
提出技能名抢注攻击,利用智能体虚构技能名劫持技能供应链
本研究系统揭示了大模型智能体技能推荐场景下的虚构技能名称安全风险,将其形式化为一种新型供应链抢注攻击。
提出OpenART竞技场,用EMHA演化持久环境以评测智能体安全
提出控制标记注入,清空工具智能体推理链以绕过思维链监控
提出CodePoisonRAG,对检索增强代码生成的知识库投毒以植入漏洞
提出基准投毒攻击,使自修改编码智能体跨代写出漏洞代码
提出ISM,协同改写技能描述与提示词以隐式操纵技能选择
提出Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私
提出CODETTA隐写框架,使多智能体在审计下隐蔽传载荷
提出SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出ECLIPSE双通道自演化提示注入,劫持长程智能体动作轨迹