AgentPrivArena project·本站收录 2026-10-07 03:14· 原文发表 日期未标AgentPrivArena 发布 Agent 隐私评测基准与运行时审计框架AgentPrivArenaAI 导读AgentPrivArena 用真实 MCP 工具和本地服务评测智能体隐私,区分敏感信息进入上下文与最终对外泄露。作者实验中,情境完整性审计将平均输出泄露率从46.8%降至17.8%,但敏感信息进入上下文的比例仍约74%至78%;因此减少输出泄露不等于避免不必要读取。结果来自特定模型和任务设置,未经独立复现,信息流提取不完整也是机制限制。另有 1 个来源报道阅读原文shouju-wang.github.io查看事件全部后续#安全评测#Agent 安全#隐私/数据泄露#MCP/工具调用#OpenAI#DeepSeek