DeepSeek 发布了其新的旗舰模型 DeepSeek V4 Pro 0813,这是一个拥有 1.6 万亿参数的混合专家模型。此次发布在智能体编码基准测试方面显示出显著的改进,在 DeepSWE、CyberGym 和 Terminal Bench 2.1 等指标上的得分大幅跃升,接近 Fable 5 等模型的性能。该模型拥有 100 万个 token 的上下文窗口和极具竞争力的定价,尽管 DeepSeek 已表示价格即将上涨。一个值得注意的缺失是缺乏视觉支持,这在社区中引起了意见分歧。 AI
影响 在智能体编码基准测试中设定了新的 SOTA(State-of-the-Art),凭借其性能和定价有可能颠覆市场,但缺乏视觉支持可能会限制其采用。
排序理由 Frontier-lab 模型发布,附带系统卡。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →