评测与基准arXiv 2609.25579·9月22日研究重新审视后门修复评测:区分总体干净效用与良性性能保持用 Dmax 与尾部损失评测后门修复的类别性能保持arXiv2609.25579发表9月22日层训练与数据层场景模型与 API被测模型ResNet18、PreActResNet18、VGG19-BN防御模型加固攻击投毒与后门深度解读完整解读
评测与基准arXiv 2609.22818·9月19日研究测量 LLM Agent 记忆投毒防御的良性场景开销测量记忆投毒防御在良性对话上的效用与 token 开销arXiv2609.22818发表9月19日层应用层场景AI Agent攻击投毒与后门组件记忆摘要写时代价落在噪声内。在没有攻击的对话上,给记忆投毒防御计价,而不是再测一轮攻击是否被挡住。深度解读完整解读