ECLIPSE:针对长程 Agent 系统的自演化隐蔽提示注入攻击
ECLIPSE结合直接与工具端注入,在LASE-Bench对DeepSeek无防御ASR为96.7%、带防御为69.2%。
- 96.7%DeepSeek,LASE-Bench,无防御,ECLIPSE,ASR
- 69.2%DeepSeek,LASE-Bench,带安全过滤,ECLIPSE,ASR
- 62.4%Claude 4.8 Opus,LASE-Bench,带安全过滤,ECLIPSE,ASR
针对长任务智能体提示词注入在集中显式注入的高可检性与分布式注入的低保真度之间的权衡,提出兼顾隐蔽与控制的攻击框架。
涵盖直接提示词注入、环境/工具侧间接注入及长任务注入研究,本文通过双通道注入与双阶段轨迹引导弥补长时程控制与隐蔽的割裂。
通过 SATS 在沙盒中合成隐蔽单轮请求,并结合静态工具工作流编码 SWE 与运行时残差补偿 DTC 实现闭环轨迹引导。
在 LASE-Bench 与 SHADE-Arena 上评测 7 款模型与 2 个原生系统,ECLIPSE 带防御 ASR 达 36.9%–69.2%,显著超越基线。
论文未设独立局限章节,作者强调需发展多源联合推理防御;实验覆盖 7 款模型、2 个基准及 4 种防御机制。
论文提出结合用户端与工具端注入的框架 ECLIPSE,在长任务基准上达成高成功率,揭示了长时程智能体面临的新安全挑战。