据报道,拥有 744B 参数的混合专家(MoE)模型 GLM-5.2 可以在消费级硬件上运行。一位用户分享说,它可以在大约 25 GB RAM 的机器上运行,而另一位用户详细介绍了其在配备 48 GB RAM 的 MacBook Pro M5 上的性能,速度在每秒 2 到 2.8 个 token 之间。这一进展表明在本地运行大型语言模型的可用性有所提高。 AI
影响 使得在个人设备上更广泛地访问和试验大型语言模型成为可能。
排序理由 用户报告的大型语言模型在消费级硬件上的性能和可用性。
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →