SpaceXAI的Grok 4.6在人工智能分析指数中获得了61分,跻身顶级AI模型之列。与一些竞争对手相比,新版本在代理性能和回合效率方面有了显著提高,以更少的回合和更少的token使用量完成了复杂任务。值得注意的是,Grok 4.6保持了其先前的定价结构,以低于GPT-5.6 Sol和Claude Opus 5等领先模型的成本提供了具有竞争力的智能。 AI
影响 为代理性能和成本效益设定了新的基准,可能迫使竞争对手匹配其效率和定价。
排序理由 前沿实验室模型发布,附带系统卡和基准测试结果。
在 Mastodon — sigmoid.social 阅读 →
- Artificial Analysis
- Artificial Analysis Intelligence Index
- Grok 4.6
- Hacker News
- SpaceXAI
- Anthropic
- Claude Fable-5
- Claude Opus-5
- GPT-5.6 "Sol"
- Grok 4.3
- Grok 4.5
- Kimi k3
- OpenAI
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →