OpenAI发布了GPT-6.1 Sol,这是一款新模型,定价具有竞争力,每百万token收费2美元/10美元,据报道在DeepSWE v1.1和AutomationBench等基准测试中表现优于之前的GPT模型和Anthropic的Opus 5.5。同时,Anthropic的Sonnet 5.5已在Agent Arena上首次亮相,占据了总排名的前三名,并在聊天类别中排名第一,尽管其每任务成本高于Opus 5.5。其他模型,如Gemini 4 Argon,以及MiMo-V2.6-Pro和Flash等开放权重模型,也在各种排行榜和评估中崭露头角。 AI
影响 OpenAI和Anthropic的新模型发布正在设定新的成本效益基准,可能影响整个行业的定价和能力。
排序理由 OpenAI发布新模型,包含性能和定价细节。[lever_c_从frontier_release降级:ic=1 ai=1.0]
- Anthropic
- Astra
- Fable 5.5
- FLASH
- Gemini 4 Argon
- GPT-6.1 Sol
- Grok 4.7
- Kimi k3
- llama.cpp
- MiMo-V2.6-Pro
- OpenAI
- Opus 5.5
- Sonnet 5.5
- WeirdML v3
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →