评测与基准arXiv:2609.22076 · 9月18日APort Vault 发布:用 4,371 条人工攻击评测 AI Agent 支付授权提出 APort Vault,评测支付智能体授权层对越权转账的拦截AI Agent·测试Claude Fable 5.1、Claude Sonnet 5、Claude Haiku 4.5 等 14 个·应用层权限与审批越狱权限与沙箱完整解读
评测与基准arXiv:2610.03448 · 10月2日研究重测 15 个提示注入检测器:基准分数难以预测 Agent 部署表现重评提示注入检测器,检验基准分数对智能体部署的预测力AI Agent·测试Horizon-Labs、Wolf Defender、Prismor-1.5B 等 15 个·应用层检测与过滤提示注入护栏与评审摘要论文揭示公开基准无法反映智能体检测器表现,检测能力源于输入格式相似而非通用防御,建议基于工具输出与低误报评测。完整解读