跳到正文
原文
arXiv:对齐与欺骗· arXiv:2609.10117· Hanyi Zhou·· 22 天前

研究揭示基于混淆的端侧 LLM 保护方案的安全边界

Understanding the Security Boundary of Obfuscation-based On-Device LLM Protection

AI 导读

论文针对 TEE 保护的端侧 LLM 提出一套混淆原语,用线性计算的双元组形式统一刻画代表性 TEE-Shielded LLM Partition(TSLP)方法,并给出这些原语组合的规范形式作为安全边界。作者据此设计原语引导的攻击方法,指出 ArrowCloak(Security'25)、TSQP(S&P'25)和 LoRO(NeurIPS'25)等 TSLP 方法存在共同脆弱性。论文随后引入两种新的混淆原语并与现有构造结合,形成扩展原安全边界的防御方案。该工作已被 ACM CCS 2026(Cycle B)接收,共 16 页。

阅读原文arxiv.org