安远AI与智谱联合发布前沿开放权重AI风险管理框架
安远AI(Concordia AI)与智谱(Z.AI)联合发布《前沿开放权重AI风险管理框架》,面向开放权重开发者及更广泛的生态,作为《前沿AI风险管理框架2.0》的配套文件,于2026年9月21日在联合国数字合作日首次公布。框架指出开放权重模型在提升透明度、研究与创新的同时带来独特风险:发布无法撤回、护栏可通过微调移除、没有单一主体能监控使用或收回模型。框架沿用从风险识别到风险治理的六个风险管理阶段,在每个阶段标出哪些协议在开放发布下失效并给出适配方案,并在部署环境、威胁来源、使能能力三个分析维度之外新增第四个维度社会韧性,衡量社会吸收和应对AI致害的能力。作者为安远AI与智谱,贡献者包括Brian Tse、Oskar Galeev、Weibing Wang、Yuan Cheng、Liang Fang、Wenbin Qiao、Xiaochen Wang、Chen Zhang。