攻击arXiv 2609.06749·9月7日PMA 攻击:针对隐私保护 LLM 中嵌入到嵌入混淆的语义流形对齐方法提出 PMA,用流形对齐从 E2EO 混淆向量恢复明文arXiv2609.06749发表9月7日层模型层场景模型与 API攻击提取与窃取组件嵌入深度解读完整解读
防御arXiv 2608.02683·8月3日S³:用多阶段防御提升 LLM 智能体安全提出 S³ 多阶段防御,由 guard agent 编排阶段安全技能检测并缓解风险arXiv2608.02683发表8月3日层应用层场景AI Agent防御监控与审计攻击投毒与后门风险Agent 危险操作组件监控器+3+3深度解读完整解读