跳到正文
原文
AgentPrivArena project·本站收录 · 原文发表 日期未标

AgentPrivArena 发布 Agent 隐私评测基准与运行时审计框架

AgentPrivArena

AI 导读

AgentPrivArena 用真实 MCP 工具和本地服务评测智能体隐私,区分敏感信息进入上下文与最终对外泄露。作者实验中,情境完整性审计将平均输出泄露率从46.8%降至17.8%,但敏感信息进入上下文的比例仍约74%至78%;因此减少输出泄露不等于避免不必要读取。结果来自特定模型和任务设置,未经独立复现,信息流提取不完整也是机制限制。

阅读原文shouju-wang.github.io