VIDRAFT 发布了 POCKET-Darwin-180B,这是其 1800 亿参数 Darwin-180B-RSI 模型的 4 位量化版本。该版本兼容 llama.cpp,可以通过利用稀疏专家混合路由和一种新颖的嫁接量化技术,在包括没有专用 GPU 的笔记本电脑在内的消费级硬件上运行。该模型的尺寸已从 360 GB 减至 111 GB,与传统的企业级 GPU 设置相比,能够以显著更低的硬件成本和系统 RAM 要求进行本地推理,同时据报道仍能保持基准准确性。 AI
影响 使大型模型能够在消费级硬件上进行本地推理,降低了开发者的成本并提高了可访问性。
排序理由 Frontier-lab 模型发布,带有系统卡 [lever_c 从 frontier_release 降级:ic=1 ai=1.0]
- Darwin-180B-RSI
- GGUF
- llama.cpp
- mixture of experts
- MMLU-Pro
- NVIDIA H100
- POCKET-Darwin-180B
- Qwen3.8 Flash-Next
- VIDRAFT
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →