Goodfire与Baseten合作推出Project Beacon安全监控
先了解这件事
Goodfire 与 Baseten 合作推出 Project Beacon,把 Goodfire 的安全栈接入 Baseten 推理平台,通过读取生成过程中的模型内部激活来定义策略,在输出到达用户或工具前检测并处置不安全事件,覆盖提示注入、越权操作、敏感数据泄露和网络滥用四类风险。其激活监控器复用模型已有计算,可在每次前向传播中低延迟运行,监控与生成并行且不阻塞响应,并与 judge 级联以降低成本。在 Kimi K3 的生产网络监控评估中,该方案检出约 93% 的有害会话,仅将 5.5% 的良性会话标记复核,judge 成本最多降低约 50 倍,且推理吞吐无明显下降。Baseten 计划未来数月先面向部分模型和受监控行为发布,再扩展至企业控制与开发者体验。
AI 根据报道生成 · 14 分钟前更新
后续时间线
- BasetenBaseten 与 Goodfire AI 推出 Project Beacon,为开放模型推理引入内联安全控制
Baseten 宣布与 Goodfire AI 合作推出 Project Beacon,在模型推理层引入主动、内联的安全控制,通过读取生成过程中的模型内部激活来定义策略,在输出到达用户或工具前检测并处置不安全事件。该方案针对提示注入、越权操作、敏感数据泄露和网络滥用四类风险,结合激活探针与文本监控,监控与生成并行且不阻塞响应生成。Baseten 计划未来数月先面向部分模型和受监控行为发布,再扩展至企业控制与开发者体验,并以少量早期合作伙伴推向市场。
- Goodfire ResearchGoodfire 与 Baseten 合作,将前沿安全监控引入开源模型
Goodfire 与 Baseten 合作推出 Project Beacon,把 Goodfire 的安全栈接入 Baseten 推理平台,实时检测开源模型智能体的不安全行为。其激活监控器复用模型已有计算,可在每次前向传播中低延迟运行,并与 judge 级联以降低成本。在 Kimi K3 的生产网络监控评估中,该方案检出约 93% 的有害会话,仅将 5.5% 的良性会话标记复核,judge 成本最多降低约 50 倍,且推理吞吐无明显下降。
相关讨论
关注度走势
每天新增来源
- 10月10日 新增 2 个来源(2 家媒体、0 个账号)