返回行业动态

Mistral发布开源多模态安全分类器Shieldstral

2026/08/04 14:02
查看原文

OmniTools 8月4日消息,Mistral AI于2026年8月4日正式发布开源多模态安全分类器Shieldstral。该模型参数量为3B,采用Apache 2.0许可证,支持文本与图像内容的安全评估,无需重新训练即可通过自然语言策略指令实时适配不同应用场景。

Shieldstral将内容审核建模为二元问答任务,接收三部分输入:评估上下文(<Instruct>)、具体安全问题(<Query>,如“该内容是否宣扬暴力?”)及待审内容(<Document>),单次前向传播即可输出校准后的连续安全分值。其在文本安全、拒绝检测、策略适应性及多模态安全等基准测试中,性能媲美或超越参数量高达7倍的同类开源守门模型。

该模型可在单张16GB NVIDIA GPU上高效运行,训练数据融合多种异构来源,并通过LoRA微调与SLERP权重合并技术整合多目标能力。Mistral表示,Shieldstral是其加入Open Secure AI Alliance后的首个开源安全模型,旨在推动上下文自适应的内容审核范式演进。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部