包括 GLM 5.3 和 Qwen 3.8 Max 在内的新型中国大语言模型,其性能水平正与 Fable 5 和 GPT Sol 等美国顶级模型相媲美。在基准测试中的性能差距已缩小至一到两分,这表明这些新模型是该领域领先地位的有力竞争者。 AI
影响 中国大语言模型正在缩小与美国领先模型的性能差距,预示着全球竞争加剧以及可能出现新的 SOTA 基准。
排序理由 该条目讨论了大语言模型的基准性能,并将中国模型与美国模型进行比较。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →