PulseAugur
实时 11:32:02

SyzygyResearch 发布高效的 35B MoE 模型 Mach-1-Additive

SyzygyResearch 发布了 Mach-1-Additive-35B,一个拥有 350 亿参数的混合专家(MoE)模型,采用 GGUF 格式。该模型专为高效设计,能够运行在内存需求低的移动和边缘设备上,并在消费级笔记本电脑上达到每秒 120 个 token 的速度。发布内容包括自定义 GGUF 文件和一个修改过的 llama.cpp 分支,以优化性能。 AI

影响 此次发布提供了一个高效的 35B MoE 模型,适用于资源受限的环境,有可能拓宽先进 AI 功能的可及性。

排序理由 发布了具有性能指标并在 Hugging Face 等平台上可用的特定模型。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

SyzygyResearch 发布高效的 35B MoE 模型 Mach-1-Additive

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/pmttyji ·

    SyzygyResearch/Mach-1-Additive-35B-GGUF · Hugging Face

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1vtcz8t/syzygyresearchmach1additive35bgguf_hugging_face/"> <img alt="SyzygyResearch/Mach-1-Additive-35B-GGUF · Hugging Face" src="https://external-preview.redd.it/5i0xoC-V8V4uXTRPZZuEu0qce6d2wKL0nga_2e35LCE.pn…