Terminal Bench v4 基准测试结果显示,GLM-5.3 是表现最佳的开源模型,显著优于同类其他模型。GLM-5.3-Flash 在闪速模型中也处于领先地位,而 Kimi-K3 的表现与其规模相比不佳。Qwen3.8-27B 被认为是唯一能够在此基准上获得分数的模型。 AI
影响 提供了对各种开源 LLM 的比较性能分析,突出了 GLM-5.3 的领先能力。
排序理由 开源 LLM 的基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
- DSV4.1-Flash
- DSV4-Flash
- DSV4-Pro
- gemma4-31b
- GLM-5.3
- Kimi-K3
- Muse Glimmer
- Qwen3.8-27B
- Qwen3.8-Flash-Next
- Terminal Bench v4
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →