攻击arXiv 2603.13847·3月14日SWhisper 用近超声隐蔽声学通道对语音驱动 LLM 实现黑盒越狱提出 SWhisper,用近超声波向语音驱动 LLM 隐蔽注入越狱提示arXiv2603.13847发表3月14日层应用层场景LLM 应用攻击者黑盒攻击越狱技术跨模态载荷组件音频+1+1深度解读完整解读
攻击arXiv 2610.05894·10月5日研究者提出闭环偏见注入攻击提出闭环激活引导,在扩散语言模型去噪过程中注入定向偏见arXiv2610.05894发表10月5日层模型层场景模型与 API攻击者灰盒攻击模型篡改技术梯度与表征优化摘要通过去噪中间概率反馈动态调节残差流转向,证明扩散语言模型在推理服务栈中存在闭环偏见注入脆弱性。深度解读完整解读
攻击arXiv 2609.24994·9月22日BAM 反馈编码实现推理时隐蔽的智能体通信提出变长反馈编码 BAM,在生成文本中隐蔽传输秘密载荷arXiv2609.24994发表9月22日层模型层场景多智能体攻击者黑盒攻击检测规避技术编码与混淆深度解读完整解读