Ollama 发布了新版本 v0.32.10 和 v0.32.9,引入了性能增强并支持新的开源模型。v0.32.10 版本通过将 repeat_penalty 默认设置为 1.0 来改进推测解码,使其与其他推理引擎保持一致并加快本地模型执行速度。两个版本都增加了对 NVIDIA 的 Nemotron 3.5 Lightning 的支持,这是一个为 AI 代理设计的 30B 专家混合模型,以及 Meta 的 Muse Glimmer 多模态模型,其中 v0.32.7 通过 MLX 引擎专门优化了 Muse Glimmer 在 Apple Silicon 上的性能。此外,Muse Glimmer 模型现在提供 GGUF 格式,使其更容易被消费级 GPU 使用。 AI
影响 通过使强大的开源模型在消费级硬件上更易于访问和更具性能,增强了本地 AI 开发和实验。
排序理由 对 Ollama 的更新,这是一个用于在本地运行 LLM 的工具,包括支持新模型和性能改进。
- AMD
- Jetpack
- Kimi K3
- Meta
- Muse Glimmer
- Nemotron 3.5 Lightning
- NVIDIA
- Ollama
- vLLM
- Apple Silicon
- GGUF
- GPU Operator v1.5.0
- Kubernetes
- Nemotron 3.5
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →