PulseAugur
实时 11:04:24
English(EN) Why have 8B-12B models been dropped?

AI模型发布越来越倾向于更大尺寸,小型模型被抛弃

消费级硬件用户注意到一个趋势:新发布的大型语言模型主要集中在27B参数及以上,而在8B-12B范围内的新模型越来越少。这一转变使得内存有限的用户,例如使用Macbook Pro M4(16GB内存)的用户,难以找到符合其系统能力的新模型。问题在于,开发高性能的8B-12B参数级别的前沿模型是否在技术上变得不可行。 AI

影响 更小、更易于访问的模型可能会变得不那么普遍,这可能会限制硬件能力较弱的用户的访问。

排序理由 Reddit上关于LLM发布规模感知趋势的用户讨论。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

AI模型发布越来越倾向于更大尺寸,小型模型被抛弃

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/_maverick98 ·

    为什么8B-12B模型被淘汰了?

    <!-- SC_OFF --><div class="md"><p>I am a Macbook Pro M4 user with the 16GB of unified ram. The best model I have been able to run on LM Studio is Gemma4 12B QAT, this model is 66 days old. After that the next best thing LM studio suggests is Nemotron 3 Nano 4B and Qwen3.5 9B, whi…