NVIDIA 宣布其 Groq 3 LPX 推理芯片已全面投入生产,据称在代理式 AI 工作负载方面实现了每秒 3,400 个 token 的处理速度。尽管 NVIDIA 声称这比 Cerebras 快四倍,但由于所需的加速器数量不同,这种比较变得复杂,NVIDIA 需要多个单元才能匹配 Cerebras 的单加速器性能。Groq 3 LPX 旨在加速代理式 AI 推理,NVIDIA 还在探索将其 CUDA 支持扩展到 RISC-V 架构以增强 GPU 计算能力。 AI
影响 加速代理式 AI 推理,可能为 AI 工作负载的速度和效率设定新的基准。
排序理由 NVIDIA 宣布其 Groq 3 LPX 推理芯片全面投入生产。
- Groq 3 LPX
- Hot Chips 2026
- NVIDIA
- SiliconANGLE
- Gemma 4 31B
- Groq 3 LPU
- Apple Inc.
- Cerebras
- CUDA
- Google Cloud
- Groq
- RISC-V
AI 生成摘要 · Google Gemini · 来自 10 个来源。 我们如何撰写摘要 →