使用 Ollama 进行了一项速度测试,以比较 muse-glimmer:30b 和 Qwen3.8:27b 的性能。Muse-glimmer:30b 的评估率为 1.85 tokens/s,而 Qwen3.8:27b 的运行速度为 1.42 tokens/s。测试还注意到它们自我报告的能力存在差异,Qwen 详细说明了其编码能力,而 muse-glimmer 则没有。 AI
影响 为本地 LLM 部署提供了性能比较。
排序理由 模型性能指标比较。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →