Mistral AI发布3B开源多模态安全模型Shieldstral
近日,法国人工智能公司Mistral AI正式发布开源多模态安全分类器Shieldstral。该模型仅含30亿参数,在文本与图像安全评估任务中表现优异,综合性能超越体积高达其七倍的同类模型。与传统安全护栏依赖固定分类标签不同,Shieldstral将内容审核重构为策略自适应问答任务。开发者可在推理阶段直接输入自然语言策略,模型无需重新训练即可动态适配多元产品场景,统一处理文本、图像及图文混合内容的安全判定。 该模型部署门槛极低,仅需单张16GB显存GPU即可高效运行,并能输出经校准的连续安全置信度分数,打破传统二分类限制。为攻克数据异构与边界模糊难题,Mistral利用自研Forge平台整合多源数据,引入对比策略生成技术强化模型对细微政策边界的逻辑判别力。Shieldstral已按Apache 2.0协议全面开放权重。作为Open Secure AI Alliance创始成员,Mistral此举标志着AI内容审核正向动态上下文适配迈进,为生成式应用的安全合规提供了轻量化、高灵活度的新范式。
