SemiAnalysis 分析了 227 万条 Claude 的响应,以追踪不同模型之间的工具使用情况。他们的发现表明,从 Claude Opus 4.6 到 Opus 4.8,工具调用的使用率呈下降趋势。然而,Claude Fable 5 偏离了这一趋势,平均每条响应的工具调用次数为 1.00 次,而 Opus 4.8 为 0.76 次,Opus 5 为 0.79 次。这表明 Fable 5 的工具使用频率更接近早期的 Opus 模型,引发了对其性能提升可能与更频繁、更准确的工具利用相关的猜测。 AI
影响 分析表明 Claude Fable 5 可能通过更频繁、更准确的工具使用来实现性能提升。
排序理由 第三方研究人员对模型行为的分析。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →