PulseAugur
实时 22:12:04
English(EN) Luce Spark: a 35B MoE on a 16 GB GPU, without the offload tax

Luce Spark 使 35B MoE 模型能在 16GB GPU 上运行

Luce Spark 是一个新开源系统,它使得大型 350 亿参数的专家混合(MoE)模型能在单个 16 GB GPU 上运行。它通过智能地仅将当前活跃的专家保留在 GPU 上,而其余专家则驻留在系统内存中并在需要时进行交换来实现这一点。这种方法避免了通常与卸载相关的性能损失,从而能够高效运行原本无法容纳的模型。 AI

影响 使得在消费级硬件上运行大型 MoE 模型成为可能,从而普及了对先进 AI 能力的访问。

排序理由 该集群描述了一个新的开源系统和方法论,用于在有限的硬件上运行大型 MoE 模型,这是高效 AI 部署领域的一项重要研究贡献。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Luce Spark 使 35B MoE 模型能在 16GB GPU 上运行

报道来源 [2]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/sandropuppo ·

    Luce Spark: 16 GB GPU 上的 35B MoE 模型,无需卸载开销

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1u0b3cu/luce_spark_a_35b_moe_on_a_16_gb_gpu_without_the/"> <img alt="Luce Spark: a 35B MoE on a 16 GB GPU, without the offload tax" src="https://preview.redd.it/tg6kpi4vs26h1.png?width=640&amp;crop=smart&amp;a…

  2. Mastodon — mastodon.social TIER_1 English(EN) · [email protected] ·

    一台 16 GB GPU 上的 35B MoE,无需卸载成本 https://www.lucebox.com/blog/spark # HackerNews # Tech # AI

    A 35B MoE on a 16 GB GPU, without the offload tax https://www.lucebox.com/blog/spark # HackerNews # Tech # AI