攻击arXiv 2609.24994
BAM 反馈编码实现推理时隐蔽的智能体通信
提出 BAM 反馈编码,在 LLM 生成文本中实现隐蔽通信
- arXiv
- 2609.24994
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 被测模型
- Llama-3.1-8B、Qwen-3.5-9B-Base、Mistral-7B-v0.3 等 6 个
- 技术编码与混淆
提出 BAM 反馈编码,在 LLM 生成文本中实现隐蔽通信
提出日志基底提示注入,操纵 SOC 分析员的分类、摘要与处置建议
摘要在 gpt-4o-mini 上,人格劫持与上下文操纵可改写 SOC 分析输出,直接覆盖在分类上无效。