DeepSeek-V4-Flash已发布,拥有超过一百万个token的超大上下文窗口,且定价极具竞争力,每百万输入token成本为0.078美元,每百万输出token成本为0.156美元。这使得它在处理大量文本的任务中具有经济可行性,例如总结大型代码库或法律文件。然而,性能测试显示其在推理任务上存在显著的延迟问题,表明虽然该模型在批量处理方面成本低廉,但其在复杂认知任务上的速度不一致,且远慢于其编码能力。 AI
影响 为大上下文LLM应用提供了新的经济基准,但用户必须仔细评估推理任务的延迟。
排序理由 Frontier-lab模型发布,系统卡片[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →