攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 LLM Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒、白盒攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
评测与基准arXiv 2609.22818·9月19日研究测量 LLM Agent 记忆投毒防御的良性场景开销测量 LLM Agent 记忆投毒防御的良性效用与 token 开销arXiv2609.22818发表9月19日层应用层场景AI Agent攻击投毒与后门组件记忆+1+1摘要写时代价落在噪声内。在没有攻击的对话上,给记忆投毒防御计价,而不是再测一轮攻击是否被挡住。深度解读完整解读