攻击arXiv 2607.00481
研究者提出 SMT 框架,通过模拟审核轨迹越狱函数调用 LLM
提出 SMT 框架,用模拟审核轨迹越狱函数调用 LLM
- arXiv
- 2607.00481
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 被测模型
- GPT-4o、GPT-5.4、Qwen3-Max 等 7 个
提出 SMT 框架,用模拟审核轨迹越狱函数调用 LLM
提出日志基底提示注入,操纵 SOC 分析员的分类、摘要与处置建议
摘要在 gpt-4o-mini 上,人格劫持与上下文操纵可改写 SOC 分析输出,直接覆盖在分类上无效。