xAI 发布了 Grok 4.6,这是 Grok 4.5 的高级继任者,专为复杂的长期任务而设计,例如研究、数据分析和完整的代码库交互。据报道,新模型可以根据产品创意生成应用程序的功能性初版,并包含增强的自我纠正和测试功能,以应对扩展任务。Artificial Analysis 的基准测试将 Grok 4.6 在 AA Intelligence Index 上的得分定为 61,与 GPT-5.6 Sol Max 相当,略微落后于 Fable 5 Max。 AI
影响 增强了复杂代理任务和代码生成的能力,有可能加速开发周期。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
- AA Intelligence Index
- Artificial Analysis
- Cloudflare
- Cursor
- Fable 5 - max
- Grok 4.5
- Grok 4.6
- Grok Build
- OpenRouter
- Vercel
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →