攻击arXiv 2609.19722
ALIBI:向二进制注入虚假安全叙事可让 LLM 恶意软件分析器误判
提出 ALIBI,向恶意二进制注入不执行掩护叙事使分析器误判为良性
- arXiv
- 2609.19722
- 发表
- 层
- 应用层
- 场景
- LLM 应用
- 攻击者
- 黑盒
- 测试
- Gemini 2.5 Pro、GPT-5.5 Pro、Claude Opus 4.7 等 4 个
摘要ALIBI 用二进制内的掩护叙事重释可疑静态证据,Gemini 上翻转多,另两模型主要为降级。
ALIBI 是针对 LLM 恶意软件分诊的语义掩护叙事攻击:不覆盖系统指令,而把仍可见的可疑静态证据重释成良性安全产品的预期行为。