Ethan Mollick 分享了他测试 Anthropic 的 Opus 5 模型时的体验,指出该模型在各种任务上总体表现强劲。然而,他观察到 Opus 5 表现出一些独特的语言怪癖,类似于在 Fable 模型中发现的那些,尤其是在其密度和 FableSpeak 的使用方面。虽然 Opus 5 在较短的任务上表现可以与 Fable 相媲美,但 Mollick 发现它在较长的任务上不够雄心勃勃且不够完整。 AI
影响 提供关于新模型性能和怪癖的用户级别反馈,为潜在用户提供信息。
排序理由 用户对模型发布的评论,而非实验室的直接公告。
在 Bluesky Jetstream — AI desk 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →