HarnessSecurity-Bench 横向评测六款编码智能体框架的安全机制
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读另有 378 篇论文还没打上分类标签,暂不在筛选结果里。
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读用 COPEX 基准在固定协议栈下评测智能体抵御 MCP 攻击的能力
完整解读提出 TPRS,量化工具命名等表征变化对智能体安全基准得分的影响
完整解读提出 EvoRiskBench,评测工作区智能体的运行时安全风险
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出 TRUSTFORK,评测展示身份如何劫持多智能体编排的操作权限
构建 Emergence World,评测长时程多智能体对抗韧性与群体失效
提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测
构建多模态技能图像攻击基准 MMSkillRisk 并设计 NCVA