2026年夏季,四家主要的中国AI实验室发布了前沿规模的模型,标志着开放权重可用性方面的重要转变。Moonshot的Kimi K3在Artificial Analysis Intelligence Index和Arena排行榜上取得了顶尖的第三方验证分数。智谱的GLM 5.2,一个专注于编码和代理的专家模型,也获得了高排名,并提供经济实惠的API访问。阿里巴巴的Qwen 3.8 Max,最新的旗舰模型,声称性能接近顶尖的专有模型,但有待独立验证。DeepSeek V4 Flash 0731以具有竞争力的价格在代理基准测试中提供了强大的性能。 AI
影响 强大开放权重模型的广泛发布预计将加速企业的采用和自托管能力。
排序理由 文章详细介绍了中国主要实验室发布的四款新的前沿规模LLM的发布和比较基准测试。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Alibaba Group
- Arena
- Artificial Analysis Intelligence Index
- Claude (Opus 4.8)
- DeepSeek
- DeepSeek-V4 Flash
- GLM-5.2
- Hugging Face
- Kimi k3
- Moonshot
- OpenRouter
- Qwen 3.8 Max
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →