OpenAI 发布了其代号为“jalapeño”的定制推理芯片的基准测试结果,该芯片是与博通(Broadcom)合作开发的。据报道,该芯片在每千瓦吞吐量和端到端延迟方面优于 NVIDIA 的 GB300 和 GB200 系统,尤其是在运行 GPT-OSS 120B 等 OpenAI 自有模型时。这种集成的系统方法,结合了硬件、内存、网络和推理软件,旨在减少数据移动和延迟,这对于代理式 AI 应用至关重要。虽然该芯片不用于训练,且 NVIDIA 的较新平台未包含在测试中,但 OpenAI 计划从 2026 年底开始在其自有数据中心部署 jalapeño。 AI
影响 这一发展标志着 OpenAI 正朝着定制硬件迈出战略性一步,可能减少对外部 GPU 供应商的依赖,并优化 AI 工作负载的性能。
排序理由 OpenAI,一家前沿实验室,发布了其定制推理芯片“jalapeño”的基准测试。[lever_c_demoted from frontier_release: ic=1 ai=0.7]
- Broadcom
- Codex
- DeepSeek R1 670B
- GB200
- GB300
- GPT-OSS 120B
- InferenceX
- jalapeño
- Kimi K2.5 1T
- NVIDIA
- OpenAI
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →