防御arXiv 2609.14003
FlowSeal:用信息流控制阻断 LLM Agent 的隐私泄露
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
- arXiv
- 2609.14003
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- DeepSeek-V3.2、DeepSeek-R1、GPT-4.1-mini 等 4 个
摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。
提出 Adaptive Diffusion Freezing,降低扩散模型的成员推理风险
占位。
提出 IDUnlearn-Bench,评测 VLM 个体级遗忘后的身份残留
IDUnlearn-Bench 评测 VLM 是否忘掉一个可跨模态识别的人,而不只是答不出某条监督事实。