攻击arXiv 2605.30883
TRACE:面向 LLM Agent 的任务感知自适应自进化越狱框架
提出 TRACE 框架,用分解与可演化多轮策略诱导智能体执行有害工作流
- arXiv
- 2605.30883
- 发表
- 层
- 应用层
- 被测模型
- Codex、Claude Code、GPT-5.5 等 6 个
提出 TRACE 框架,用分解与可演化多轮策略诱导智能体执行有害工作流
提出 DREAM 框架,评测 Agent 的跨环境长链攻击脆弱性
摘要DREAM 提出基于知识图谱与策略搜索的动态红队框架,分析了长链跨环境攻击对当前主流智能体的系统性威胁。
提出 STAC 框架,把恶意目标拆成多轮看似无害的工具调用链
摘要作者提出并验证了智能体在序列化工具攻击下的普遍脆弱性,指出针对累积动作序列防御的必要性。