研究人员开发了SIRF,一种用于工业内容风险控制的新型基础模型。SIRF通过持续预训练将复杂的平台策略直接内化到其权重中,从而实现超低延迟的高精度风险评估。在一项比较研究中,SIRF-8B-SFT在Black Recall@P95方面比基线模型有了显著的15.1个百分点的提升,仅使用了少量持续预训练的token而未损害通用能力。这种方法允许作为裁决层进行高效部署,恢复了大量被错误处罚的样本,并以较低的成本有效地迁移到新场景。 AI
影响 该模型策略内化的方法可能会简化工业应用中的风险控制,从而提高效率和准确性。
排序理由 该集群包含一篇详细介绍新模型及其在特定基准上性能的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →