您的位置:首页 >最强多模态内容审核AI模型:Mistral推出Shieldstral
发布于2026-08-11 阅读(0)
扫一扫,手机访问
Mistral AI 最近动作不断,昨天(8月4日)又放出了一款新模型——Shieldstral,一个专门做内容审核的AI,参数量只有3B(30亿),但亮点不少。模型采用开放权重,基于Apache 2.0许可证发布,已经在Hugging Face平台上线。支持12种语言,单张16GB GPU就能跑起来。Mistral方面表示,在内容安全任务上,这个3B模型的表现能跟7倍规模的其他开放模型掰手腕,而且在多模态内容审核领域直接做到了当前最先进水平(SOTA)。

补充一句,SOTA就是state-of-the-art的缩写,指的是在特定AI任务或基准测试中表现最顶尖的模型或算法集合,这个头衔会随着技术迭代不断易主。

目前大多数防护模型有个通病:伤害类别体系是直接固化在模型权重里的。一旦产品换了个使用场景,开发者往往得重新训练模型才能适配。Shieldstral的思路不一样——它把审核政策直接塞进输入内容里。操作者可以写一个“是或否”的问题,再配上评估场景和严格程度的说明,模型随后从单个输出词元中生成一个经过校准的安全分数。
具体来说,模型把每项审核任务都转化成一个二元问答,输入包含三个带标签字段:
推理时,模型只读取“是”和“否”这两个词元的逻辑值,再通过softmax归一化为连续分数,并以0.5为阈值输出二元判断。这套机制能覆盖提示词分类、回答审核、拒答检测和毒性检测,灵活性相当高。

售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9