PulseAugur
实时 23:41:52
English(EN) Qwen3.8-27B Q4 on Strix Halo (395): n-max=4 median 21.23 tok/s, 0 replies under 15 — 96-request MTP matrix

Qwen3.8-27B 模型在 Strix Halo 硬件上实现 21.23 tok/s

一位用户分享了 Qwen3.8-27B 模型在 Strix Halo 硬件上使用 Q4 量化运行的性能指标。基准测试显示,在 96 个请求中,中位数推理速度为每秒 21.23 个 token,最大序列长度 (n-max) 为 4。这些数据在一个多 token 预测 (MTP) 矩阵中呈现。 AI

影响 为特定模型和硬件配置提供了具体的性能数据,有助于用户评估类似的配置。

排序理由 用户分享的特定模型和硬件配置的性能指标。

在 r/cursor 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Qwen3.8-27B 模型在 Strix Halo 硬件上实现 21.23 tok/s

报道来源 [1]

  1. r/cursor TIER_2 English(EN) · /u/creativenew ·

    Qwen3.8-27B Q4 on Strix Halo (395): n-max=4 median 21.23 tok/s, 96-request MTP matrix, 15以下回复为0

    <table> <tr><td> <a href="https://www.reddit.com/r/cursor/comments/1vwkhzd/qwen3827b_q4_on_strix_halo_395_nmax4_median_2123/"> <img alt="Qwen3.8-27B Q4 on Strix Halo (395): n-max=4 median 21.23 tok/s, 0 replies under 15 — 96-request MTP matrix" src="https://preview.redd.it/3bd5v5…