攻击arXiv 2610.09973·10月7日从期望危害到似然:LLM 智能体越狱的概率重构提出 OPUR 攻击,用似然梯度优化对抗后缀越狱 LLM 智能体arXiv2610.09973发表10月7日层应用层场景AI Agent攻击者白盒被测模型Llama-3.1-8B-Instruct、Ministral-8B-Instruct-2410攻击越狱技术梯度与表征优化+1+1深度解读完整解读
攻击arXiv 2603.13847·3月14日SWhisper 用近超声隐蔽声学通道对语音驱动 LLM 实现黑盒越狱提出 SWhisper,用近超声波向语音驱动 LLM 隐蔽注入越狱提示arXiv2603.13847发表3月14日层应用层场景LLM 应用攻击者黑盒被测模型Meta-Llama-3.1-8B-Instruct、Gemma-3-4B、Qwen2.5-7B-Instruct 等 9 个攻击越狱技术跨模态载荷组件音频+1+1深度解读完整解读