研究:94% 开发者未能识破编码 Agent 的隐蔽破坏
评测人类开发者在协作编程中能否发现编码智能体的隐蔽破坏
完整解读评测人类开发者在协作编程中能否发现编码智能体的隐蔽破坏
完整解读提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读提出 TPRS,量化工具命名等表征变化对智能体安全基准得分的影响
完整解读提出 EvoRiskBench,评测工作区智能体的运行时安全风险
红队评估编码智能体的阻断监视器,并提出 Auto Mode++加固
提出 ECLIPSE 双通道自演化提示注入,劫持长程智能体动作轨迹
完整解读提出 EvasionBench,测量任务压力下智能体对同步监控的规避
完整解读提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测
构建多模态技能图像攻击基准 MMSkillRisk 并设计 NCVA