一位用户分享了在 Bosgame M5 配备 RTX Pro 6000 Max-Q eGPU 上运行 DeepSeek-V4-Flash-0731 模型的性能基准测试。基准测试详细说明了各种量化级别(UD-Q8_K_XL、UD-Q4_K_XL、UD-Q2_K_XL)及其相应的解码和预填充速度,以及草稿接受率。用户还提供了使用不同配置运行模型的特定命令行参数,包括集成从已关闭的拉取请求移植的 DSpark drafter。 AI
影响 为在特定硬件配置上运行 DeepSeek-V4-Flash-0731 的用户提供了实际性能数据。
排序理由 用户生成的开源模型性能基准测试。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →