Reddit 的 r/LocalLLaMA 社区的一位用户分享了 DeepSeek-V4 模型的高度优化量化版本,该版本专为拥有大量显存(192GB+)的 Mac 设备设计。该版本在 Hugging Face 上可用,据报道其性能优于其他方法,并且在使用过程中生成速度会加快。用户强调其 dspark/mtp 支持是其在 M3 Ultra Mac 上高效运行的关键因素。 AI
影响 此次优化有望提高先进 LLM 在消费级 Apple 硬件上的性能和可访问性。
排序理由 用户分享的现有模型针对特定硬件的优化。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →