mistral.rs
PulseAugur coverage of mistral.rs — every cluster mentioning mistral.rs across labs, papers, and developer communities, ranked by signal.
- 2026-06-18 product_launch mistral.rs released version 0.8.10 with support for OpenAI-compatible Agent Skills. 来源
- 2026-06-04 product_launch The mistral.rs project released support for the Gemma 4 12B model, adding multimodal and agentic capabilities. 来源
- 2026-06-01 product_launch Mistral.rs released version 0.8.2, featuring significant CUDA inference speed improvements. 来源
-
mistral.rs v0.9.0 的 CPU 解码速度比 llama.cpp 快 1.8 倍
mistral.rs 项目已发布 0.9.0 版本,在大型语言模型的 CPU 解码方面展示了显著的性能提升。基准测试显示,在 x86 和 ARM 架构上,mistral.rs 的速度比 llama.cpp 快 1.8 倍。这些优化旨在惠及所有模型,并适用于包括支持 AVX2、AVX512 和 NEON 的各种 CPU。
-
mistral.rs 为本地模型添加了 OpenAI 兼容的 Agent Skills
mistral.rs 项目发布了 0.8.10 版本,通过 /v1/skills 端点引入了对 OpenAI 兼容的 Agent Skills 的支持。这项新功能允许本地开源模型执行领域指令和脚本,为自托管 AI 系统带来了先进的代理能力。更新还包括对文件附件和生成文件输出的支持,并为 NVIDIA CUDA、Apple Silicon 和 CPU 提供了预构建的二进制文件。
-
mistral.rs 添加 Gemma 4 12B 多模态和智能体支持
mistral.rs 项目已添加对 Google 的 Gemma 4 12B 模型支持,实现了包括音频、图像和视频处理在内的多模态能力。此次集成允许开发者构建具有网络搜索和安全代码执行等功能的智能体应用程序。该项目提供了一步式简便安装流程,并启动了一个兼容 OpenAI 和 Anthropic 的 HTTP 服务器,内置用户界面。
-
Mistral.rs 提升 CUDA 推理速度;非 CUDA 状态存争议
mistral.rs 项目发布了 0.8.2 版本,在各种 NVIDIA GPU 上将 CUDA 推理速度相比 llama.cpp 提升了高达 2.8 倍。此次更新专注于优化 Gemma 4 等模型的吞吐量,在不同量化类型和模型架构上均观察到性能提升。同时,关于大型语言模型非 CUDA 推理的状态和可行性的讨论正在进行中,语音转文本等一些任务在 CPU 上显示出潜力,而其他任务仍然严重依赖 CUDA。