Fireworks AI 宣布,其平台利用 DeepSeek V4 Pro 模型在 SWE-Bench 和 LiveCodeBench 基准测试中表现优于 Anthropic 的 Claude Fable 5。与某些可能拒绝此类工作的闭源模型不同,DeepSeek V4 Pro 提供了更低的每个已解决任务的成本,并表现出更愿意执行合法的安全审查任务。 AI
影响 强调了 AI 推理任务(尤其是在编码和安全审查方面)的潜在成本节省和性能提升。
排序理由 推理平台宣布了模型在基准测试上的性能和成本效益。
在 X — Fireworks (inference infra) 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →