CARE:安全高效的人机协作决策框架
Careful Judge: Safe and Efficient Human-AI Collaborative Decision Making
AI 导读
CARE(calibrated adaptive rectification and escalation)是一套端到端人机协作决策流程,结合 AI 模型与人工审核,在持续从人工反馈中学习、提升自动化水平的同时保证决策安全且与人类对齐。其自适应校准模块可在任意时间步为任意修正模块提供风险控制保证,并适用于任何黑盒 AI 模型。在驾驶、语言和机器人四个安全关键数据集上,CARE 在实现人类对齐决策的同时,将人工查询量较基线减少 25-81%。