攻击arXiv 2609.33910
论文提出残留授权重放攻击:长期运行 Agent 的授权可跨任务复用
提出残余权限重放攻击,跨任务复用长期 Agent 的历史授权绕过确认
- arXiv
- 2609.33910
- 发表
- 层
- 应用层
- 被测模型
- GPT-4.1、Gemini-3.1-Flash-Lite、Qwen3-14B 等 6 个
提出残余权限重放攻击,跨任务复用长期 Agent 的历史授权绕过确认
提出针对 Agent Harness 的上下文特权提升攻击
提出 BENCHJACK,审计 Agent 基准中的奖励作弊缺陷
论文系统研究了主流 AI 智能体基准评测中的奖励作弊问题,提出了首个针对基准缺陷的自动化红队审计与生成对抗式迭代修补系统 BENCHJACK。