Baseten旗下的研究机构Base Labs宣布与Hugging Face和Goodfire AI建立合作,共同为开放权重模型构建安全评估与监控基础设施,并计划发布一套透明的开放模型安全标准。此举的背景是开放权重模型的安全争议日益加剧:通过“消融”技术移除模型安全防护的现象正在蔓延,Hugging Face平台上目前已列出超过6000个被消融的模型。Base Labs主张将安全性内嵌于模型的训练与部署环节,而非事后附加,并认为开放性是AI安全的优势而非威胁。Goodfire专注模型可解释性,有望承担安全机制“内嵌”的技术实现。Baseten此前完成15亿美元F轮融资,估值达130亿美元,Goodfire也获得1.5亿美元B轮融资。该合作同时向开发者生态发出公开邀请,意在推动形成兼顾安全与可及性的开放模型生态。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅