CredLeak-Bench
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御
用 COPEX 基准在固定协议栈下评测智能体抵御 MCP 攻击的能力
完整解读用 MMPIBench 评测智能体框架的多模态提示注入
提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出 LongPIBench,评测长文档场景下的提示注入攻击与防御
提出卡点评测框架,以实参级谓词审计间接提示注入评测的测量偏差