xAI 的 Grok 4.6 在人工智能分析指数上已达到与 OpenAI 的 GPT-5.6 Sol 的同等水平。此外,Grok 4.6 在代理任务方面展现了更高的效率,仅用 53 步即可完成,而 Claude Opus 5 则需要 103 步。此性能是在成本显著降低的情况下实现的。 AI
影响 xAI 的 Grok 4.6 对比领先模型展现出具有竞争力的性能和效率,可能影响定价和采用策略。
排序理由 Frontier-lab 模型发布,附带基准测试比较。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →