跳到正文
原文
arXiv:Agent 与 MCP 安全· arXiv:2609.24662· Ivan Aleksandrov·· 10 天前

DUMA-Bench:评估 LLM Agent 安全的双控多智能体基准

DUMA-Bench: A Dual-Control Multi-Agent Benchmark for Evaluating LLM Agent Security

AI 导读

研究者提出 DUMA-Bench,一个在双控交互下测量 LLM Agent 安全的基准与评测协议,其中 Agent 和用户都能影响共享环境状态。该基准在 τ²-bench 基础上扩展出对抗环境,覆盖 RAG 投毒、跨 Agent 操纵和不安全输出处理等八类漏洞。作者评测了来自 OpenAI、Anthropic、DeepSeek、Qwen 等五个模型家族的 14 个模型,跨八个领域和多种用户行为模式。实验显示,引入双控交互后攻击成功率从 26.9% 升至 41.1%,说明 Agent 安全不只取决于模型本身,还来自模型、用户与环境之间的交互。

阅读原文arxiv.org