Baseten 与 Goodfire AI 推出 Project Beacon,为开放模型推理引入内联安全控制
Project Beacon: Bringing safety signals to open models at scale
AI 导读
Baseten 宣布与 Goodfire AI 合作推出 Project Beacon,在模型推理层引入主动、内联的安全控制,通过读取生成过程中的模型内部激活来定义策略,在输出到达用户或工具前检测并处置不安全事件。该方案针对提示注入、越权操作、敏感数据泄露和网络滥用四类风险,结合激活探针与文本监控,监控与生成并行且不阻塞响应生成。Baseten 计划未来数月先面向部分模型和受监控行为发布,再扩展至企业控制与开发者体验,并以少量早期合作伙伴推向市场。
阅读原文