一个名为 Qwen3.8-27B-QUASAR-NVFP4 的 Qwen3.8-27B 模型的新完全量化版本已发布。该模型采用了一种名为 QUASAR 的新型量化感知蒸馏 (QAD) 算法,对所有线性层实现了激进的 NVFP4 量化。尽管量化程度很高,该模型在 GPQA-Diamond 和 AIME26 等基准测试中仍表现出与原始 BF16 版本相当的性能,同时将其大小显著减小到 19.7 GB。 AI
影响 使得在更少的 VRAM 上运行更大的模型成为可能,从而可能使更广泛的群体能够获得先进的 AI 能力。
排序理由 发布了一个具有新 QAT 算法和基准测试结果的量化模型。[lever_c_demoted from research: ic=1 ai=1.0]
- AIME26
- GPQA-Diamond
- Inferact/Qwen3.8-27B-NVFP4
- NVFP4
- QUASAR QAD
- QUASAR-QAT/Qwen3.8-27B-QUASAR-NVFP4
- Qwen3.8-27B
- unsloth/Qwen3.8-27B-NVFP4
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →