攻击arXiv 2610.05894·10月5日研究者提出闭环偏见注入攻击提出闭环激活引导,在扩散语言模型去噪过程中注入定向偏见arXiv2610.05894发表10月5日层模型层场景模型与 API攻击者灰盒攻击模型篡改技术梯度与表征优化摘要通过去噪中间概率反馈动态调节残差流转向,证明扩散语言模型在推理服务栈中存在闭环偏见注入脆弱性。深度解读完整解读
攻击arXiv 2608.03642·8月4日规避与投毒攻击对恶意软件数据漂移检测器的实证分析用通用扰动对恶意软件分类器及漂移检测器做规避与后门投毒arXiv2608.03642发表8月4日层模型层场景模型与 API攻击检测规避技术梯度与表征优化+2+2深度解读完整解读