攻击arXiv 2610.04195·10月3日MemLeak 研究:多租户 Agent 共享向量记忆库存在跨用户记忆泄露评估多租户智能体共享向量记忆的跨用户泄露与主动桥接arXiv2610.04195发表10月3日层应用层场景AI Agent攻击提取与窃取技术诱导选用组件记忆+2+2深度解读完整解读
评测与基准arXiv 2604.02947·4月3日AgentHazard:评估计算机使用智能体有害行为的基准提出 AgentHazard 基准,评测计算机使用智能体的执行层有害行为arXiv2604.02947发表4月3日层应用层场景网页与电脑操作、编程 Agent攻击恶意使用摘要AgentHazard 评估了计算机使用智能体的执行安全,作者认为模型层对齐无法可靠保障智能体层面的安全性。AgentHazard 是针对计算机使用智能体执行层安全构建的评估基准,重点探究多步工具调用下局部合理动作累积引发的危害。深度解读完整解读