Mistral AI发布了Shieldstral 1.0 3B,一个专为策略适应性设计的开源权重安全分类器。与依赖固定危害类别的传统模型不同,Shieldstral使用自然语言问题进行内容审核,允许操作员在推理时定义自定义策略。这种方法使该模型在文本和多模态安全基准测试中都取得了强劲的性能,其表现可与更大的模型相媲美,同时能在配备16GB显存的单GPU上高效运行。 AI
影响 为各种应用提供灵活的本地内容审核,可能减少对第三方供应商的依赖。
排序理由 前沿实验室模型发布,附带系统卡。
在 Mastodon — mastodon.social 阅读 →
- Mistral AI
- Shieldstral
- Axolotl
- GPT-OSS-Safeguard-20B
- llama.cpp
- Ministral-3-3B-Base-2512
- Pixtral
- Shieldstral 1.0 3B
- vLLM
AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →