攻击arXiv 2609.36576·9月29日AdaLCPI:让 Agent 从长上下文碎片中重建间接提示注入提出 AdaLCPI,把恶意指令拆成碎片嵌入工具返回并诱导 Agent 越权执行arXiv2609.36576发表9月29日层应用层场景AI Agent被测模型GPT-4.1、GPT-5.1、GPT-5.6-Luna 等 7 个攻击提示注入技术编码与混淆+1+1深度解读完整解读
攻击arXiv 2609.24994·9月22日BAM 反馈编码实现推理时隐蔽的智能体通信提出 BAM 反馈编码,在 LLM 生成文本中实现隐蔽通信arXiv2609.24994发表9月22日层应用层场景AI Agent被测模型Llama-3.1-8B、Qwen-3.5-9B-Base、Mistral-7B-v0.3 等 6 个技术编码与混淆深度解读完整解读