研究者披露 AP2 支付协议的 Whisper 提示注入攻击并提出 A-VIP 防御
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
另有 383 篇论文还没打上分类标签,暂不在筛选结果里。
提出 A-VIP,将购物意图绑定到支付授权以阻断商户文本操控
提出 WebMirage,用对抗图像劫持视觉网页智能体的浏览器操作
WebMirage 是一个面向视觉定位网络智能体的流水线感知端到端红队攻击框架。
提出持久视觉记忆注入,使对抗图像经缓存在触发时操控输出
提出 BENCHJACK,自动审计智能体基准的奖励作弊缺陷
论文系统研究了主流 AI 智能体基准评测中的奖励作弊问题,提出了首个针对基准缺陷的自动化红队审计与生成对抗式迭代修补系统 BENCHJACK。
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体
完整解读系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
完整解读提出 HOOKPRY,利用插件生命周期钩子更新劫持智能体框架执行命令
完整解读提出 A2A-TIBA 间接提示注入,诱导智能体部署常驻回调并外传数据
A2A-TIBA 把间接提示注入和绕过放进 A2A:gray-box 攻击者已能投递任务,诱导目标部署常驻回调程序后,下令和外传不再经过智能体。
提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
提出残余权限重放攻击,跨任务复用已批准授权绕过确认
完整解读提出工具智能体的状态攻击 DART 与预执行防御 SAGE
构建多模态技能图像攻击基准 MMSkillRisk 并设计 NCVA