品玩8月5日讯,据 AI Weekly 报道,Mistral近日宣布开源其30亿参数多模态安全分类模型Shieldstral,采用Apache 2.0许可证。该模型可在单张16GB显存的Nvidia GPU上运行。
Mistral声称,Shieldstral在文本安全、拒绝检测、策略适应性及多模态基准测试中,表现可匹配或超越规模大7倍的开源安全模型。
Shieldstral的核心设计在于其策略应用方式。开发者无需在固定分类中选择,而是可在推理时以自然语言提问形式定义策略,模型将通过单次前向传播返回校准后的“是/否”概率。这实现了文本与图像的统一接口,且策略变更无需重新训练。Shieldstral也是Mistral与Nvidia等机构组建的“开放安全AI联盟”的首个成果。