CredLeak-Bench
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读另有 378 篇论文还没打上分类标签,暂不在筛选结果里。
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御
用 StegoMemory 测试智能体持久记忆作为跨会话隐写信道的可行性
构建 AGENTDOXX 评测联网搜索智能体对匿名访谈的再识别能力
提出 OpenART 竞技场,用 EMHA 演化持久环境以评测智能体安全
完整解读评测编码智能体记忆文件中的提示注入及其跨会话持久性
Bad Memory 在沙箱合成工作区里评测文件型持久记忆上的提示注入,比较载荷能否改变当前会话,以及能否在后续会话中留下或叠加。
红队评估编码智能体的阻断监视器,并提出 Auto Mode++加固
构建 AGENTTELL 基准,测量浏览器智能体跨站行为侧信道泄露
提出卡点评测框架,以实参级谓词审计间接提示注入评测的测量偏差