Reddit 的 r/LocalLLaMA 子版块的一位用户分享了他们在 DeepSeek flash v4 模型上取得高 به性能的成功。通过使用两台 ASUS GX10 DGX 计算机,他们能够维持超过每秒 65 个 token 的速度,提示评估为 2570。该用户描述此设置可提供可用结果,并强烈推荐。 AI
影响 展示了特定硬件在本地 LLM 部署中可实现的性能。
排序理由 用户分享的特定硬件配置的性能结果,并非官方发布或基准测试。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →