一位用户分享了 DeepSeek-V4-Flash-0731-UD-Q3_K_XL 模型在配备三块 NVIDIA RTX 3090 GPU 的设备上的基准测试结果。结果显示,pp512 测试的每秒 token 数为 116.04,tg128 测试的每秒 token 数为 7.71。用户指出可能还有进一步优化的空间,但尚未取得更好的性能。 AI
影响 提供了特定模型配置的性能数据,对拥有类似硬件的用户有帮助。
排序理由 用户生成的特定模型量化基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →