评测与基准arXiv 2610.07639
HarnessSecurity-Bench 横向评测六款编码智能体框架的安全机制
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
- arXiv
- 2610.07639
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 测试
- GLM-5.2、Qwen3.8-27B、Claude Opus 4.8 等 4 个
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
提出 MAMJ,在元层面交替优化多模态越狱的策略提示与攻击者权重
系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵
提出 SceneJail,利用视频情境上下文越狱视频多模态模型