商城首页欢迎来到中国正版软件门户

您的位置:首页 >最强多模态内容审核AI模型:Mistral推出Shieldstral

最强多模态内容审核AI模型:Mistral推出Shieldstral

  发布于2026-08-11 阅读(0)

扫一扫,手机访问

Mistral AI 最近动作不断,昨天(8月4日)又放出了一款新模型——Shieldstral,一个专门做内容审核的AI,参数量只有3B(30亿),但亮点不少。模型采用开放权重,基于Apache 2.0许可证发布,已经在Hugging Face平台上线。支持12种语言,单张16GB GPU就能跑起来。Mistral方面表示,在内容安全任务上,这个3B模型的表现能跟7倍规模的其他开放模型掰手腕,而且在多模态内容审核领域直接做到了当前最先进水平(SOTA)。


补充一句,SOTA就是state-of-the-art的缩写,指的是在特定AI任务或基准测试中表现最顶尖的模型或算法集合,这个头衔会随着技术迭代不断易主。


目前大多数防护模型有个通病:伤害类别体系是直接固化在模型权重里的。一旦产品换了个使用场景,开发者往往得重新训练模型才能适配。Shieldstral的思路不一样——它把审核政策直接塞进输入内容里。操作者可以写一个“是或否”的问题,再配上评估场景和严格程度的说明,模型随后从单个输出词元中生成一个经过校准的安全分数。

具体来说,模型把每项审核任务都转化成一个二元问答,输入包含三个带标签字段:

:说明评估场景和严格程度。:提出单个“是或否”问题,比如“这段内容是否宣传身体暴力?”:提供待审核内容,可以是提示词、回答、提示词与回答的组合,也可以是附带可选文本的图像。

推理时,模型只读取“是”和“否”这两个词元的逻辑值,再通过softmax归一化为连续分数,并以0.5为阈值输出二元判断。这套机制能覆盖提示词分类、回答审核、拒答检测和毒性检测,灵活性相当高。


本文转载于:https://www.163.com/dy/article/L3IMQ9K20511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注