HarnessSecurity-Bench 横向评测六款编码智能体框架的安全机制
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读另有 95 篇论文还没打上分类标签,暂不在筛选结果里。
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读提出 TPRS,量化工具命名等表征变化对智能体安全基准得分的影响
完整解读提出 EvoRiskBench,评测工作区智能体的运行时安全风险
提出 MisKnow-Agent,评测深度研究智能体是否采纳误导性检索知识
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测
构建多模态技能图像攻击基准 MMSkillRisk 并设计 NCVA