PulseAugur
实时 04:04:22
English(EN) Ollama v0.32.9 Integrates Nemotron 3.5 — Plus vLLM, JetPack, & AMD MoE

Ollama 更新通过 Nemotron 3.5 和 Muse Glimmer 支持提升本地 AI 推理能力

Ollama 发布了新版本 v0.32.10 和 v0.32.9,引入了性能增强并支持新的开源模型。v0.32.10 版本通过将 repeat_penalty 默认设置为 1.0 来改进推测解码,使其与其他推理引擎保持一致并加快本地模型执行速度。两个版本都增加了对 NVIDIANemotron 3.5 Lightning 的支持,这是一个为 AI 代理设计的 30B 专家混合模型,以及 MetaMuse Glimmer 多模态模型,其中 v0.32.7 通过 MLX 引擎专门优化了 Muse Glimmer 在 Apple Silicon 上的性能。此外,Muse Glimmer 模型现在提供 GGUF 格式,使其更容易被消费级 GPU 使用。 AI

影响 通过使强大的开源模型在消费级硬件上更易于访问和更具性能,增强了本地 AI 开发和实验。

排序理由 对 Ollama 的更新,这是一个用于在本地运行 LLM 的工具,包括支持新模型和性能改进。

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Ollama 更新通过 Nemotron 3.5 和 Muse Glimmer 支持提升本地 AI 推理能力

报道来源 [2]

  1. dev.to — LLM tag TIER_1 English(EN) · soy ·

    Ollama v0.32.10 加速推测性解码 — 另有 Nemotron 3.5 和 AMD GPU 操作

    <p>Today's digest highlights Ollama v0.32.10, bringing faster speculative decoding, alongside NVIDIA's new Nemotron 3.5 Lightning open-weight model for agents. Additionally, AMD released GPU Operator v1.5.0 with key Kubernetes enhancements, and new GGUF models are trending.</p> <…

  2. dev.to — LLM tag TIER_1 English(EN) · soy ·

    Ollama v0.32.9 集成 Nemotron 3.5 — 以及 vLLM、JetPack 和 AMD MoE

    <p>Today brings significant advancements in AI, led by Ollama v0.32.9's integration of NVIDIA Nemotron 3.5 Lightning. We also cover vLLM v0.27.0, a new AMD Mixture-of-Experts model, further Ollama updates, and NVIDIA's latest agentic AI tools and JetPack release.</p> <h2> Local A…