评测与基准arXiv:2610.07359 · 10月6日论文实测 Agent 工具调用门控栈的失败相关性提出 nmult 指标,测量智能体动作门禁堆叠的错误相关性与等效层数AI Agent·测试GPT-5.5 (gpt55)、claude-haiku-4-5-20251001、claude-sonnet-5 等 6 个·应用层护栏与评审+1+1摘要论文实测发现大模型裁判间错误显著相关,作者主张按机制选型并在整栈层面度量防护增益。论文是一项针对智能体动作拦截防御堆叠故障关联性与实际组合价值的实证测量研究。完整解读
评测与基准arXiv:2610.03448 · 10月2日研究重测 15 个提示注入检测器:基准分数难以预测 Agent 部署表现重评提示注入检测器,检验基准分数对智能体部署的预测力AI Agent·测试Horizon-Labs、Wolf Defender、Prismor-1.5B 等 15 个·应用层检测与过滤提示注入护栏与评审摘要论文揭示公开基准无法反映智能体检测器表现,检测能力源于输入格式相似而非通用防御,建议基于工具输出与低误报评测。完整解读