研究者披露 AP2 支付协议的 Whisper 提示注入攻击并提出 A-VIP 防御
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
另有 383 篇论文还没打上分类标签,暂不在筛选结果里。
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出
提出 SkillPoison,用局部有效的成功经验投毒自进化智能体的技能形成
SkillPoison 提出了一种针对自进化智能体经验到技能形成过程的攻击范式,通过组织已验证的成功经验诱导技能过度泛化。
评估多租户智能体共享向量记忆的跨用户泄露与主动桥接
完整解读用 StegoMemory 测试智能体持久记忆作为跨会话隐写信道的可行性
提出 HDI 攻击以篡改 GraphRAG 辅助结构破坏检索
提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据
提出 SigLeak,从执行轨迹比对中推断专有智能体技能
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
提出技能名抢注攻击,利用智能体虚构技能名劫持技能供应链
本研究系统揭示了大模型智能体技能推荐场景下的虚构技能名称安全风险,将其形式化为一种新型供应链抢注攻击。
提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出自博弈红队智能体 GPT-Red,自动挖掘提示注入与越狱攻击
完整解读提出 AHA 自动科研循环,发现生产级智能体的可复用漏洞概念
AHA 是一项针对生产级 LLM 智能体自动化红队测试的研究,旨在解决传统方法仅保留具体攻击载荷而缺乏成因解释、导致跨版本复用困难且无法指导修复的问题。
提出 OpenART 竞技场,用 EMHA 演化持久环境以评测智能体安全
完整解读提出控制标记注入,清空工具智能体推理链以绕过思维链监控
提出 CodePoisonRAG,对检索增强代码生成的知识库投毒以植入漏洞
提出基准投毒攻击,使自修改编码智能体跨代写出漏洞代码
提出 LLMLeak,把机密编进报错 URL,借聊天机器人网页抓取外传
LLMLeak 研究一种隐蔽外传:本地恶意软件已拿到机密,却因为网络限制或监控不能直接连接攻击者,于是把秘密放进看起来像排障文档的 URL,让良性聊天机器人的网页抓取工具在访问时把秘密带出去。
提出 A2A-TIBA 间接提示注入,诱导智能体部署常驻回调并外传数据
A2A-TIBA 把间接提示注入和绕过放进 A2A:gray-box 攻击者已能投递任务,诱导目标部署常驻回调程序后,下令和外传不再经过智能体。
提出 ISM,协同改写技能描述与提示词以隐式操纵技能选择
完整解读