xAI 发布了 Grok 4.6,该模型旨在用于长期 Agent 和复杂的交互式任务,而不是实现原始智能的飞跃。该公司声称其在 Artificial Analysis Intelligence Index 上可与 GPT-5.6 Sol 相媲美,并在其他基准测试中与 GPT-5.6 Sol 和 Fable 5 争夺领先地位,尽管它在实际终端工作等领域表现出弱点。Grok 4.6 的定价为每百万输入 token 2 美元起,每百万输出 token 6 美元,还有一个速度更快的版本,价格是其两倍。 AI
影响 此次发布标志着在 Agent 能力和前沿模型之间的基准测试竞争方面持续受到关注。
排序理由 前沿实验室模型发布,包含系统卡和基准测试数据。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →