攻击arXiv 2610.09973·10月7日从期望危害到似然:LLM 智能体越狱的概率重构提出 OPUR 攻击,用似然梯度优化对抗后缀越狱 LLM 智能体arXiv2610.09973发表10月7日层应用层场景AI Agent攻击者白盒被测模型Llama-3.1-8B-Instruct、Ministral-8B-Instruct-2410攻击越狱技术梯度与表征优化+1+1深度解读完整解读
攻击arXiv 2609.26761·9月23日A2M:针对 MCP 生态的两阶段 Agent 劫持框架提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持 AgentarXiv2609.26761发表9月23日层应用层场景AI Agent被测模型GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个攻击提示注入技术自动化搜索组件MCP 与技能+1+1深度解读完整解读