2026-08-05 · AI 资讯
Mistral推出3B审核模型Shieldstral,实现单卡跑出SOTA性能

Mistral AI发布了全新内容审核模型Shieldstral,该模型拥有30亿参数,采用Apache 2.0许可在Hugging Face开源。其最大优势在于仅需16GB GPU显存即可运行,却能提供媲美数倍规模模型的防护性能,成为多模态审核领域的开源SOTA。

Shieldstral的设计思路与传统模型显著不同。它不再将伤害类别固定在权重内,而是将审核政策作为输入的一部分。通过将审核任务转化为“是/否”的二元问答,模型能根据开发者定义的场景和严格程度,通过校准后的安全分数进行实时判断,具备极高的灵活性与可定制性。
该模型支持12种语言,能够覆盖提示词分类、回答审核及毒性检测等多种场景。其低资源占用的特性,使开发者能够在消费级显卡上部署高水准的安全保障系统,有效提升了多模态内容审核的普及度与可操作性。
相关模型(97AI 可直接调用)
