MiniMax H3 文本编码器已量化至 NVFP4 发布,其大小显著小于原始的 26.4 GB,现在可以安装在单个 16 GB 显卡上。该模型使用 Qwen3-VL-32B 作为其文本编码器,并采用分体式 Transformer 架构。讨论表明,虽然较小的量化版本很常见,但它们可能会影响提示的准确性,而 FP8 混合版本提供了更好的平衡。 AI
影响 此次发布提供了更易于访问的 MiniMax H3 文本编码器版本,可能允许在消费级硬件上进行更广泛的实验和使用。
排序理由 量化模型的发布及其技术规格和性能的讨论。
在 Mastodon — mastodon.social 阅读 →
- MiniMax H3
- Qwen3-VL-32B
- Int8
- Qwen3-VL-32B-Instruct-layer50_bf16.safetensors
- Administrador de Infraestructuras Ferroviarias
- Mastodon
- NVFP4
- Tono_Ken3
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →