对 MineBench 基准测试中 Fable 5.1 和 Fable 5 的比较显示,Fable 5.1 的成本几乎是 Fable 5 的三倍,推理时间也大约是其两倍。这种成本和时间的增加似乎源于 Fable 5.1 中显著更长的推理过程。尽管运营成本更高,Fable 5.1 仍显示出显著的改进,包括在构建中创建可识别的内部元素,以及一种更接近 Anthropic 的 Opus 5 的风格。 AI
影响 Fable 5.1 成本和推理时间的增加凸显了模型能力与效率之间的权衡,可能影响用户的选择和开发重点。
排序理由 在特定基准测试中比较模型性能和成本。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →