Mistral AI 发布 3B 内容审核模型 Shieldstral,支持单卡多模态审核

Mistral AI 于 8 月 4 日发布内容审核模型 Shieldstral-1.0-3B,采用开放权重并以 Apache 2.0 许可证上线 Hugging Face。该模型参数规模为 30 亿,支持 12 种语言,可在单张 16GB GPU 上运行。Shieldstral 将审核政策写入输入,通过二元问答对提示词、回答、拒答、毒性及图像文本等内容进行评分与判断。Mistral 称,其内容安全性能可媲美规模大 7 倍的开放模型,并在多模态审核任务中达到开源 SOTA。

上一篇:

下一篇:

发表回复

登录后才能评论