PulseAugur
实时 22:44:35

DeepSeek-V4-Flash-0731 在 RTX Pro 6000 Max-Q 上的性能基准测试详情

一位用户分享了在 Bosgame M5 配备 RTX Pro 6000 Max-Q eGPU 上运行 DeepSeek-V4-Flash-0731 模型的性能基准测试。基准测试详细说明了各种量化级别(UD-Q8_K_XL、UD-Q4_K_XL、UD-Q2_K_XL)及其相应的解码和预填充速度,以及草稿接受率。用户还提供了使用不同配置运行模型的特定命令行参数,包括集成从已关闭的拉取请求移植的 DSpark drafter。 AI

影响 为在特定硬件配置上运行 DeepSeek-V4-Flash-0731 的用户提供了实际性能数据。

排序理由 用户生成的开源模型性能基准测试。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

DeepSeek-V4-Flash-0731 在 RTX Pro 6000 Max-Q 上的性能基准测试详情

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/backslashHH ·

    DeepSeek-V4-Flash-0731 on Bosgame M5 with RTX PRO 6000 Max-Q eGPU

    <!-- SC_OFF --><div class="md"><p>Here are my numbers:</p> <table><thead> <tr> <th align="left">Quant</th> <th align="left">Size</th> <th align="left">Layout</th> <th align="left">Decode</th> <th align="left">Prefill</th> <th align="left">Draft acceptance</th> </tr> </thead><tbod…