一项近期对23个大语言模型的能力和API价格进行的比较分析显示,最昂贵的模型不一定是最聪明的。Epoch能力指数(ECI)被用来根据各种基准对模型进行评分,价格数据来源于截至2026年10月的API列表。研究发现,像Claude Opus 5.5和GPT-6 Astra这样的顶级模型虽然能力很强,但并非最具成本效益。像Claude Sonnet 5.5、Gemini 3.8 Flash和DeepSeek-V4 Flash这样更便宜但仍然强大的模型,在常见任务中提供了显著的价值。 AI
影响 为各种任务确定具有成本效益的大语言模型,指导开发人员和企业进行模型选择。
排序理由 对大语言模型能力和价格进行比较的分析,并非直接发布或产品发布。
- Artificial Analysis Intelligence Index
- Claude Fable 5-1
- Claude Opus 5.5
- Claude Sonnet 5.5
- DeepSeek-V4 Flash
- Epoch AI
- Epoch Capabilities Index
- Gemini-3.1 Pro
- Gemini 3.8 Flash
- GPT-5.5
- GPT-6 Astra
- GPT-6 Sol
- Claude
- GPT-6.1 Sol
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →