Mistral AI 发布 3B 多模态安全分类模型 Shieldstral
Mistral AI 开源发布 3B 参数的多模态安全分类模型 Shieldstral,采用 Apache 2.0 协议。该模型将内容审核重构为自然语言问答任务,支持在推理时动态传入安全策略以统一评估文本与图像,无需针对新分类标准重新训练。模型可在单张 16GB GPU 上运行,单次前向传播即可输出校准的安全置信度分数,性能比肩或超过 7 倍于其体积的基准模型。
推荐理由:它将内容审核抽象为问答任务,支持在推理时直接用自然语言定义策略,为低成本构建自定义多模态防护栏提供了实用方案。