一位用户在多智能体编码系统中测试了 Anthropic 的 Fable 5、Opus 5 和 Opus 4.8 模型。Fable 5 Low 作为更优的协调者脱颖而出,与 Opus 5 相比,它展现了更自然的委托和对规则的遵守。虽然 Opus 5 作为编写者表现出色,但其领导代理行为更像独立开发者,有时会忽略依赖关系。Opus 4.8 High 提供了一个强有力的替代方案,显示出比 Opus 5 更强的反思性推理能力,尽管 Fable 5 仍然能更有效地集成只读代理。 AI
影响 表明 Fable 5 可能比 Opus 5 更适合复杂的、基于规则的协调任务。
排序理由 用户进行的现有模型实际测试和比较。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →