研究人员开发了一种新颖的知识蒸馏技术,为大型语言模型创建更小、更高效的安全分类模型。这些蒸馏模型在精心策划的数据集上进行训练,并按许可证进行分类,可以在几秒钟内运行在普通CPU上。最小的生成式学生模型在无害提示上的误报率为3.8%,优于80亿参数的教师模型的4.8%的误报率,而编码器模型大约在24毫秒内对请求进行分类。 AI
影响 使得在能力较弱的硬件上部署LLM安全功能成为可能,降低了延迟和成本。
排序理由 该集群包含一篇详细介绍创建更小AI模型新方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →