AntLing’ve 发布了其 Ling-3.0-tiny 和 Ling-3.0-flash 模型的六个基础模型检查点。这些检查点涵盖了预训练、中期训练和 WSM 合并阶段,为研究人员提供了灵活的起点以进行进一步开发。Ling-3.0-tiny 模型虽然体积较小,但在基准测试中,尤其是在编码方面,表现出与更大模型相当或更优的性能。Ling-3.0-flash 模型在编码、推理和长上下文任务方面也展现出强大的能力,其性能优于体积是其数倍的模型。 AI
影响 为研究人员提供了开发和微调语言模型的灵活起点,有望加速在编码和推理能力方面的进步。
排序理由 研究实体发布基础模型检查点的开源版本。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →