Ollama 发布了 0.34.1 版本,带来多项重要更新。该版本使 MLX safetensors 的 "ollama create" 功能不再处于实验阶段,并改进了 Apple Silicon 上 MLX 的内存处理。此外,GGUF 模型创建现在需要使用 llama.cpp 工具进行 safetensor 转换和量化,并且优化了 runaway repeat token 检测以减少误报。 AI
影响 提高了 Ollama 用户本地部署 LLM 的可用性和性能。
排序理由 这是用于本地运行 LLM 的工具的软件发布,并非前沿模型发布或核心研究。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →