PulseAugur
实时 04:41:47
日本語(JA) Ollama 0.30.8のバイナリには"MLXランナー"が埋め込まれている。だがGGUFモデルは一度もそこを通らなかった — M1 Max 64GBで2モデル実測

Apple Silicon 上的 Ollama 0.30.8:GGUF 模型未激活 MLX runner

Ollama 0.30.8 版本的最新分析显示,尽管二进制文件包含 MLX runner 的代码,但在 Apple Silicon 上运行标准 GGUF 模型时,它似乎并未被使用。在 M1 Max 64GB Mac 上进行的调查发现,即使测试了不同的模型架构,日志也一直显示 `llama-server` 是活动的 runner。这表明通过典型的 `ollama pull` 和 `ollama run` 命令运行模型的用户可能无法获得 MLX 所声称的性能提升。 AI

影响 调查 Ollama 等本地 LLM runner 实际使用的后端对于优化特定硬件上的性能至关重要。

排序理由 对特定软件版本功能的技木分析。

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Apple Silicon 上的 Ollama 0.30.8:GGUF 模型未激活 MLX runner

报道来源 [1]

  1. dev.to — LLM tag TIER_1 日本語(JA) · bigkijimon ·

    Ollama 0.30.8 二进制文件内嵌了“MLX runner”。但 GGUF 模型从未经过它——在配备 64GB 内存的 M1 Max 上对 2 个模型进行了测量

    <p>「Ollamaが新しくMLXバックエンドに対応して、Apple SiliconでのローカルLLM推論が速くなった」という話をたまに見かける。手元はM1 Max 64GBのMac、Ollamaは0.30.8。じゃあ自分の環境でも恩恵があるのか確かめようとして、まず引っかかった。<strong>そもそも自分が普段 <code>ollama pull</code> して <code>ollama run</code> しているモデルは、本当にMLXランナーを通っているのか?</strong> 確かめずにtok/sだけ測っても、比較する土台が無い。バイナリ…