Ollama 发布了 0.32.15 版本,为首次使用的用户引入了新的桌面引导流程。此更新通过缓存已解析的模型元数据显著提高了性能,将首次响应时间(time-to-first-token)大约缩短了一半,从近一秒缩短到略高于半秒。此外,该版本还修复了解析器错误后出现的聊天和生成问题,并确保了 Qwen 3.8 系统消息的处理一致性。 AI
影响 此次更新增强了本地部署 LLM 的用户体验和性能,可能增加对 Ollama 等工具的采用。
排序理由 这是一个用于本地运行 LLM 工具的软件发布,而不是前沿模型发布或核心研究。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →