Mistral AI 于 8 月 4 日发布内容审核模型 Shieldstral-1.0-3B,采用开放权重并以 Apache 2.0 许可证上线 Hugging Face。该模型参数规模为 30 亿,支持 12 种语言,可在单张 16GB GPU 上运行。Shieldstral 将审核政策写入输入,通过二元问答对提示词、回答、拒答、毒性及图像文本等内容进行评分与判断。Mistral 称,其内容安全性能可媲美规模大 7 倍的开放模型,并在多模态审核任务中达到开源 SOTA。
Mistral AI 于 8 月 4 日发布内容审核模型 Shieldstral-1.0-3B,采用开放权重并以 Apache 2.0 许可证上线 Hugging Face。该模型参数规模为 30 亿,支持 12 种语言,可在单张 16GB GPU 上运行。Shieldstral 将审核政策写入输入,通过二元问答对提示词、回答、拒答、毒性及图像文本等内容进行评分与判断。Mistral 称,其内容安全性能可媲美规模大 7 倍的开放模型,并在多模态审核任务中达到开源 SOTA。