评测与基准arXiv 2410.13886·2024年10月11日Scale AI 与 CMU 发布 BrowserART:拒答训练的大模型作为浏览器 Agent 极易被越狱提出 BrowserART,评测拒答训练在浏览器 Agent 上的泛化arXiv2410.13886发表2024年10月11日层应用层场景web agent被测模型o1-preview、o1-mini、GPT-4o (gpt-4o-2024-08-06) 等 8 个攻击越狱深度解读完整解读