斯坦福与 UC Berkeley 发布 MobileCybench:用可执行探针评测 Agent 漏洞发现
提出MobileCybench,用可执行探针评测编程智能体的漏洞发现与利用
该研究提出了基于可执行安全属性探针的自动化评估基准 MobileCyBench,用于衡量 AI 智能体在移动应用及后端环境下的漏洞挖掘与利用生成能力。
提出MobileCybench,用可执行探针评测编程智能体的漏洞发现与利用
该研究提出了基于可执行安全属性探针的自动化评估基准 MobileCyBench,用于衡量 AI 智能体在移动应用及后端环境下的漏洞挖掘与利用生成能力。
提出AgentCyberRange,评测智能体自主实施网络攻击的能力