一位 Reddit 用户分享了 EschaLabs/Qwen3.6-35B-A3B-Escha-W2 模型与 APEX (Q5 Balanced) 模型之间的基准测试对比。Escha 模型在生成速度和预填充速度方面均显著更快,分别快 1.85 倍和 2.48 倍。尽管 APEX 模型在 wikitext-2 上表现出较低的困惑度,但 Escha 模型在指令遵循、数学推理、代码生成和博士级别问题方面表现相当或更好,并在 GPQA-Diamond 上取得显著优势。 AI
影响 展示了高效、高性能的本地 LLM 的潜力,特别是对于拥有 AMD GPU 的用户。
排序理由 特定模型变体的用户生成基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →