DeepGrove发布了Maple-Preview,一个专注于推理能力的开源20B-A1B三元权重LLM。该模型在其权重级别上展现了最先进的性能,甚至可以与更大的模型竞争并解决复杂问题。它实现了令人印象深刻的推理速度,在Mac Mini M4上运行速度超过200 tokens/秒,显著优于Gemma、Qwen 3.5和gpt-oss等模型。 AI
影响 在其权重级别上设定了推理基准的新SOTA,可能影响未来高效模型的发展。
排序理由 Frontier-lab模型发布,带有系统卡[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- DeepGrove
- deepgrove/maple-preview
- Docker
- Gemma
- gpt-oss
- Hugging Face
- Mac Mini M4
- Qwen 3.5
- SGLang
- transformers
- vLLM
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →