HyperAIHyperAI

Command Palette

Search for a command to run...

LLM
生成式 AI

Base Labs联手Hugging Face与Goodfire共建开源权重AI安全标准

近日,AI推理服务商Baseten联合其旗下研究机构Base Labs,与Hugging Face及安全初创公司Goodfire AI共同宣布,推出面向开源权重AI模型的新一代安全基础设施标准。此次合作旨在应对开源大模型领域日益严峻的安全挑战。随着消融等去除安全护栏技术的扩散,模型潜在滥用风险急剧上升,Hugging Face平台目前已收录逾6000个存在此类隐患的开源模型。 针对行业痛点,Base Labs将主导开发模型训练与实时监控方法,致力于构建透明可追溯的安全评估体系。该标准强调将安全机制深度内嵌至模型的开发与部署流程,而非事后附加。合作三方指出,开源生态的透明度能为AI安全提供独特优势,有助于将研究迅速转化为可执行的管控措施。Goodfire AI将依托其模型可解释性技术,为架构提供底层支撑。 资金方面,Baseten于六月完成15亿美元F轮融资,估值达130亿美元;Goodfire亦于今年完成1.5亿美元B轮融资。目前,Base Labs已向全球开发者发起协作邀请,旨在联合产业力量打造安全可靠且高度开放的开源AI生态,推动行业治理向标准化迈进。

相关链接