Unsloth 发布了 DeepSeek-V4-Flash-0731 模型 GGUF 格式的优化版本,使其更易于在本地运行。这些模型与 llama.cpp、Ollama、LM Studio 和 Unsloth Studio 等各种流行推理工具兼容。性能基准测试表明,该模型可以在具有 40GB VRAM 的硬件上高效运行,生成速度超过每秒 16 个 token。 AI
影响 促进了更广泛的本地部署和对先进语言模型的实验。
排序理由 此次发布的是用于本地使用和现有推理工具的优化模型格式,而不是主要实验室发布的新前沿模型。
在 Hugging Face Trending Models 阅读 →
- A100
- DeepSeek-V4-Flash-0731
- llama.cpp
- LM Studio
- Ollama
- Unsloth
- unsloth/DeepSeek-V4-Flash-0731-GGUF
- Unsloth Studio
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →