SyzygyResearch 发布了 Mach-1-Additive-35B,一个拥有 350 亿参数的混合专家(MoE)模型,采用 GGUF 格式。该模型专为高效设计,能够运行在内存需求低的移动和边缘设备上,并在消费级笔记本电脑上达到每秒 120 个 token 的速度。发布内容包括自定义 GGUF 文件和一个修改过的 llama.cpp 分支,以优化性能。 AI
影响 此次发布提供了一个高效的 35B MoE 模型,适用于资源受限的环境,有可能拓宽先进 AI 功能的可及性。
排序理由 发布了具有性能指标并在 Hugging Face 等平台上可用的特定模型。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →