攻击arXiv 2609.06749·9月7日PMA 攻击:针对隐私保护 LLM 中嵌入到嵌入混淆的语义流形对齐方法提出 PMA,用流形对齐从 E2EO 混淆向量恢复明文arXiv2609.06749发表9月7日层模型层场景模型与 API被测模型BERT-base、RoBERTa-base、T5-base 等 6 个攻击提取与窃取组件嵌入深度解读完整解读
攻击arXiv 2609.01222·9月1日研究者提出上下文权限提升攻击,12 款 Agent 框架均受影响提出针对 Agent Harness 的上下文特权提升攻击arXiv2609.01222发表9月1日层应用层场景coding agent被测模型GPT-5.5、GPT-5.4 mini、Claude-Sonnet-4.6 等 7 个攻击提示注入技术潜伏触发组件记忆+2+2深度解读完整解读