Reddit 的 r/LocalLLaMA 子版块上一位用户对 DeepSeek V4 Flash 0731 模型表示失望,指出该模型持续无法遵循基于规则的提示和技能。这个问题在预览版和闪电版中都存在,导致用户无法针对特定任务微调模型的行为,从而在实际编码场景中表现不佳。用户将此与他们使用 Qwen 27B 的经历进行了对比,认为 DeepSeek V4 尽管在基准测试中可能表现出色,但由于这些实际限制,未能达到真正的最前沿能力。 AI
影响 强调了新模型可能存在的实际局限性,这些局限性可能阻碍其在基准测试表现出色的情况下被采用。
排序理由 用户对特定模型发布的意见文章。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →