r/LocalLLaMA subreddit 上的一位用户正在为专家混合(MoE)模型提出新功能,特别是建议“--disk-moe”或“--n-disk-moe”选项。这些选项将允许将模型层卸载到磁盘或中央处理单元(CPU)以及图形处理单元(GPU),从而使更大的模型可以在性能较低的硬件上运行。 AI
影响 通过利用磁盘存储进行卸载,可以在消费级硬件上运行更大的模型。
排序理由 关于本地 LLM 部署的 subreddit 上的用户提议。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →