四款新的前沿人工智能模型——Claude Fable 5.1、GPT-6 Astra、GPT-6.1 Sol 和 Gemini 4 Argon——在一个月内发布,各有独特的优势和定价结构。虽然基准测试分数显示出一些重叠,但每项任务的成本、缓存能力和访问策略的差异显著影响了它们对各种应用的适用性。OpenAI 因内部测试失败取消了 GPT-6.1 Astra,将 GPT-6 Astra 作为其当前顶级模型。Gemini 4 Argon 在知识工作和长周期编码方面处于领先地位,而 GPT-6 Astra 在软件工程和计算机使用方面表现出色。GPT-6.1 Sol 定位为通用用途的经济高效选项,而 Claude Fable 5.1 在编码和推理任务中表现强劲。 AI
影响 新模型提供专业能力和成本效益,指导用户为特定工作负载选择最佳匹配。
排序理由 对多款前沿人工智能模型在基准测试、定价和访问方面的比较。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- ARC-AGI-2
- Artificial Analysis Intelligence Index
- Claude Code
- Claude Fable 5.1
- Claude Opus 5.5
- Gemini 4 Argon
- Google DeepMind
- GPT-6.1 Sol
- GPT-6 Astra
- OpenAI
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →