DeepSeek 发布了其 V4.1 Flash 模型,这是一个拥有 552B 参数的专家混合(Mixture-of-Experts)模型,该模型速度惊人,并且 KV 缓存大小显著减小,使其成为最便宜的前沿模型之一。尽管该模型在各种基准测试中表现出色,并且采用了激进的定价策略,但它似乎在市场采用方面遇到了困难,与 OpenAI 等成熟的竞争对手相比,其 API 使用量仅占很小一部分。这种差距凸显了开发人员对尖端、经济高效的模型感兴趣,与这些模型在生产环境中的实际部署之间存在差距。 AI
影响 此次发布凸显了在竞争激烈的 LLM 格局中,模型性能、成本与实际开发者采用率之间持续存在的紧张关系。
排序理由 重要 AI 实验室发布新模型,包含详细的技术规格和定价,以及市场采用分析。[lever_c_demoted from significant: ic=1 ai=1.0]
- Codeforces
- DeepSeek
- DeepSeek V4.1 Flash
- DeepSeek V4-Pro
- DeepSWE v1.1
- GitHub
- GPQA Diamond
- Hacker News
- Matthew D. Berman
- OpenAI
- OpenRouter
- Terminal-Bench 2.1
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →