对 Qwen3.8-27B 模型在 AIME 2026 数学数据集上的基准测试显示,其量化的 FP8 权重在设置为 xhigh 推理时,获得了 29/30 的分数。此性能在相同的 xhigh 推理设置下与 BF16 版本相当,但速度显著提高。FP8 xhigh 配置在速度更快的情况下,也达到了 BF16 medium 设置的分数。 AI
影响 在复杂推理任务上展现出强大性能,可能影响未来数学问题解决模型的开发。
排序理由 特定模型在数学数据集上的基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →