CredLeak-Bench
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读另有 383 篇论文还没打上分类标签,暂不在筛选结果里。
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御
构建统一滥用监视基准,用危害窗口评测跨威胁动作监控
用 COPEX 基准在固定协议栈下评测智能体抵御 MCP 攻击的能力
完整解读提出 TPRS,量化工具命名等表征变化对智能体安全基准得分的影响
完整解读重评提示注入检测器,检验基准分数对智能体部署的预测力
用 MMPIBench 评测智能体框架的多模态提示注入
构建 ActBench 评测协作智能体多步执行中的操作级行为安全
提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆
本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。
提出 LongPIBench,评测长文档场景下的提示注入攻击与防御
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出卡点评测框架,以实参级谓词审计间接提示注入评测的测量偏差