评测与基准arXiv 2610.05586
AgentDoxx:联网搜索 Agent 对匿名访谈文本的再识别评测
用 AGENTDOXX 评测搜索 Agent 对匿名访谈的再识别
- arXiv
- 2610.05586
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- GLM-5.3 Flash、GPT-5.6 Terra、GPT-5 Mini 等 10 个
- 攻击恶意使用
摘要论文提出了已知身份的重识别基准 AGENTDOXX,揭示搜索与记忆双重风险及现有防御在检索轨迹中的泄露漏洞。
用 AGENTDOXX 评测搜索 Agent 对匿名访谈的再识别
摘要论文提出了已知身份的重识别基准 AGENTDOXX,揭示搜索与记忆双重风险及现有防御在检索轨迹中的泄露漏洞。
提出 CryptanalysisBench,评测模型端到端破解真实密码原语的能力
摘要提出真实密码原语分析基准,证实前沿模型具备显著分析能力并能发现未公开设计缺陷。
提出 MobileCybench,用可执行探针评测编程智能体的漏洞发现与利用
提出 OpenART 竞技场,用 EMHA 演化持久环境以评测智能体安全
提出 KaliBench,评测模型把安全意图译成 Kali 命令的能力
提出 AgentCyberRange,评测智能体自主实施网络攻击的能力
摘要构建开放多靶场评测基础设施 AGENTCYBERRANGE,测定前沿 AI 网络攻击能力并揭示其端到端规划短板。
构建 AGENTTELL 基准,测量浏览器智能体跨站行为侧信道泄露
摘要论文评估了浏览器智能体的行为侧信道泄露风险,并基于近万次会话提供了评测数据。
提出 RevLeakBench 测量交付物修订痕迹造成的无意泄露
修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。