DeepSeek 发布了其 V4 模型的两个不同版本:DeepSeek V4 Pro 和 DeepSeek V4 Flash。V4 Pro 是一个更大的模型,拥有 1.6 万亿总参数和 490 亿活跃参数,专为推理、编码和研究等复杂任务而设计。相比之下,V4 Flash 是一个注重效率的模型,拥有 2840 亿总参数和 130 亿活跃参数,适用于高吞吐量、低延迟和成本受控的工作负载。两个模型都共享 100 万 token 的上下文窗口,并支持高级功能,如思考模式和非思考模式、JSON 输出和工具调用,但在定价和架构上存在显著差异。 AI
影响 为开发者提供了针对不同工作负载的不同选择,平衡了能力与成本和延迟。
排序理由 Frontier-lab 模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →