研究者披露 AP2 支付协议的 Whisper 提示注入攻击并提出 A-VIP 防御
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
另有 383 篇论文还没打上分类标签,暂不在筛选结果里。
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
提出 WebMirage,用对抗图像劫持视觉网页智能体的浏览器操作
WebMirage 是一个面向视觉定位网络智能体的流水线感知端到端红队攻击框架。
提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出
提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据
提出 TrustProbe,挖掘技能内容流向特权操作的信任链漏洞
完整解读提出 PRETEXT,迭代改写技能文本以绕过扫描并执行木马行为
PRETEXT 是一项针对基于“静态规则加语义大模型”的智能体技能安全检测框架的白盒攻击与协同进化评估研究。
提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体
完整解读提出 APEX,用跨技能进度记录夹带虚假授权劫持智能体
完整解读提出 SigLeak,从执行轨迹比对中推断专有智能体技能
提出技能名抢注攻击,利用智能体虚构技能名劫持技能供应链
本研究系统揭示了大模型智能体技能推荐场景下的虚构技能名称安全风险,将其形式化为一种新型供应链抢注攻击。
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
完整解读提出 HOOKPRY,利用插件生命周期钩子更新劫持智能体框架执行命令
完整解读提出 memetic trojans,把对抗载荷嵌入智能体自发转发的社会传染内容
Memetic trojans 是一类网络介导攻击:对抗载荷搭在智能体本来就会转发和点赞的内容上扩散,转发者不必被攻陷,也不必执行“请继续复制”的指令。
提出 A2A-TIBA 间接提示注入,诱导智能体部署常驻回调并外传数据
A2A-TIBA 把间接提示注入和绕过放进 A2A:gray-box 攻击者已能投递任务,诱导目标部署常驻回调程序后,下令和外传不再经过智能体。
提出 ISM,协同改写技能描述与提示词以隐式操纵技能选择
完整解读提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测