开放权重AI模型已显著缩小与专有模型的性能差距,到2026年4月在智能指数上缩小至6分以内。尽管如此,企业对开放模型的采用却滞后,使用率在一年内从19%降至11%。一个关键因素是服务堆栈,相同的开放权重模型在工具调用评估中的性能差异可达15个百分点,具体取决于提供商。虽然开放模型正变得更具成本效益,但在减少幻觉和复杂推理或编码任务的性能方面仍落后于专有选项。 AI
影响 开放权重模型在能力和成本方面正变得具有竞争力,但服务堆栈优化对于广泛的企业采用仍然至关重要。
排序理由 该项目讨论了AI模型的基准测试结果和性能指标,包括开放权重和专有选项,并分析了它们的能力和成本效益。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- Artificial Analysis
- Claude 3.7 Sonnet
- Claude Opus 4.7
- DeepSeek V3 0324
- DeepSeek V4 Pro
- Gemini 3.1 Pro Preview
- GPT-5.5
- GPT-5.6 Luna
- Kimi K2.6
- MiMo V2.5 Pro
- Moonshot AI
- OpenAI
- Xiaomi
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →