Ollama 版本 0.32.6 已发布,通过 MLX 和推测解码显著提升了 Qwen3.5 模型在 Apple GPU 上的性能。此次更新增强了 Apple Silicon 用户在本地进行 AI 推理的能力。此外,Qwen3-VL-32B 模型的一个新的 INT8 量化版本正在 Hugging Face 上流行,使得大型多模态模型更容易在消费级硬件上使用。 AI
影响 提升了消费级硬件上的本地 AI 推理性能,使得更强大的模型更容易被 Apple Silicon 用户使用。
排序理由 该集群详细介绍了软件更新(Ollama),该更新提高了特定硬件(Apple GPU)的性能,以及一个流行的模型变体(Qwen3-VL)和优化技术(INT8 量化),符合“工具”类别,代表了软件和模型可访问性的改进。
- AMD
- Apple GPUs
- ComfyUI
- Hugging Face
- INT8 quantization
- MLX
- NVIDIA
- Ollama
- OpenAI
- Qwen 3.5
- Qwen3-VL-32B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →