Baseten 与 Goodfire AI 合作推出 Project Beacon,将安全信号引入开放模型推理

💡 灵机 AI 深度洞见与核心提炼
Baseten 宣布与 Goodfire AI 合作推出 Project Beacon,通过在模型生成过程中读取内部激活值,将主动式安全控制引入模型推理层。该方案针对提示词注入、越权操作、敏感数据泄露和网络滥用等风险,由激活探针与文本监控并行分类每个请求,再按客户策略决定批准、拒绝、回退或记录。监控与生成并行、不阻塞响应,未来数月将先覆盖部分模型和受监控行为,再扩展至企业管控与开发者体验。
信源媒体:Baseten 工程博客(网页)
访问出处网页 ↗