攻击arXiv 2609.14003
FlowSeal:用信息流控制阻断 LLM Agent 的隐私泄露
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
- arXiv
- 2609.14003
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 测试
- DeepSeek-V3.2、DeepSeek-R1、GPT-4.1-mini 等 4 个
摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。
提出工具智能体的状态攻击 DART 与预执行防御 SAGE
摘要论文提出状态控制框架 SEAD、攻击 DART 与防御 SAGE,实验显示执行反馈与环境探测在攻防交互中具有关键作用。