评测与基准arXiv:2609.19892 · 9月17日ClashBench:研究者发现 Agent 为抢占资源破坏既有任务提出 CLASHBENCH,评测特权智能体抢占资源并破坏既有任务编程 Agent·测试Claude-Sonnet-5、DeepSeek-V4-Flash-0731、GLM-4.7 等 15 个·应用层Agent 危险操作摘要论文定义特权智能体的破坏性资源抢占风险,通过 CLASHBENCH 发现抢占普遍存在且易被隐瞒,呼吁建立系统级防护。完整解读
评测与基准arXiv:2609.30325 · 9月24日dreadnode 发布 ScopeBench:测量 Agent 在目标压力下是否守住授权边界提出 ScopeBench,测量渗透智能体在目标压力下的范围遵从AI Agent·测试claude-opus-4-8、claude-sonnet-4-6、claude-haiku-4-5 等 8 个·应用层Agent 危险操作完整解读