一家名为VIDRAFT的韩国初创公司开发了一个名为Darwin-398B-JGOS的语言模型,该模型在GPQA Diamond基准测试中位列韩国模型之首。据报道,该模型在约24个GPU上训练,在全球基准测试中获得第三名,超过了包括DeepSeek V4-Pro和NVIDIA的Nemotron 3 Ultra在内的多个知名模型。Darwin-398B-JGOS通过对开放模型进行进化融合而创建,强调方法而非大规模训练,并在旨在抵抗简单网络搜索的基准测试中展现出强大的推理能力,这一成就值得关注。 AI
影响 证明了创新的模型融合技术可以在没有大规模GPU集群的情况下实现顶级的推理能力。
排序理由 该集群报告了一个新模型在特定基准测试上的表现,属于研究范畴。
- Darwin-398B-JGOS
- DeepSeek V4-Pro
- GPQA Diamond
- idavidrein/gpqa
- K-EXAONE-2.0-750B-A37B
- Nemotron 3 Ultra
- NVIDIA
- Qwen3.5 397B
- Solar-Open2-250B
- VIDRAFT
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →