Secure-CUA:约束计算机使用智能体中不可信内容的影响
Secure-CUA: Controlling Untrusted Influence in Computer-Use Agents
AI 导读
研究者提出 Secure-CUA,一种面向计算机使用智能体(CUA)的安全执行方案,通过在执行前固定动作事务,约束不可信内容对智能体决策与 GUI 命令执行的影响。该方法把安全要求形式化为对智能体决策及其通过 GUI 命令执行两方面的约束,并在理想执行模型下说明逐步满足这两项要求可保护执行轨迹。Secure-CUA 的核心是在访问不可信内容前先确定一个显式的单动作程序(action transaction),固定对不可信内容的查询及响应的允许用途;系统遮蔽不可信区域,用隔离的查询模型作答,再借助遮蔽后的界面定位目标控件。作者在 400 个 WebArena 任务上用三个前沿模型、5 个随机种子共 6000 条执行轨迹测试,Secure-CUA 平均任务成功率为 53.55%,Vanilla-CUA 为 55.12%,CaMeL-CUA 为 13.17%。