Mistral AI发布了Shieldstral,一款新的30亿参数安全模型,专为轻量级、策略感知型AI生成内容审核而设计。该模型可处理文本和图像,在文本安全方面得分84.9%,图像安全方面得分83.8%。Shieldstral易于集成,无需重新训练模型,可在标准GPU上高效运行,并利用自然语言策略做出特定上下文的安全决策。 AI
影响 提供了一个轻量级、策略感知型的审核解决方案,无需重新训练即可集成,有望加速安全AI的部署。
排序理由 Frontier-lab模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →