评测与基准arXiv 2609.24662
DUMA-Bench:评估 LLM Agent 安全的双控多智能体基准
提出双控多智能体基准 DUMA-Bench,评测 Agent 策略违反
- arXiv
- 2609.24662
- 发表
- 层
- 应用层
- 场景
- 多智能体
- 测试
- GPT-5、GPT-5-mini、GPT-5-nano 等 14 个
- 攻击提示注入
摘要DUMA-Bench 用双控交互评测智能体安全。
DUMA-Bench 把 τ²-bench 的双控交互做成智能体安全评测,用来看策略违反如何随用户、模型和环境一起出现。