评测与基准arXiv:2610.07089 · 10月5日研究者提出统一滥用监控基准,覆盖分解攻击与提示注入约 6200 条轨迹构建统一滥用监视基准,用危害窗口评测跨威胁动作监控AI Agent·测试Gemma 4 26B-A4B、Qwen3.6 27B、Qwen3.5 27B 等 12 个·应用层监控与审计越狱多轮渐进监控器+1+1摘要统一智能体滥用监视框架,动作视角兼顾两类威胁但危害定位仍存瓶颈。完整解读