AMD与Cerebras正合作开发一个新的AI推理平台,该平台将结合AMD的EPYC处理器和Instinct加速器与Cerebras的Wafer-Scale Engine (WSE)解决方案。此次合作旨在通过分离工作负载来优化AI推理,由AMD处理提示处理和大上下文窗口,而Cerebras的WSE负责管理内存带宽密集型的token生成。该组合产品预计将提高每瓦特每秒的token数量,并将于2026年下半年通过Cerebras Cloud提供。 AI
影响 此次合作旨在通过优化专用硬件组件之间的工作负载分配来提高AI推理效率。
排序理由 知名硬件供应商之间的合作,旨在创建一个专用的AI推理解决方案。
在 Mastodon — mastodon.social 阅读 →
- AE7100E
- RPP Architecture
- XPower Technology
- AMD
- AMD EPYC
- Cerebras
- Cerebras Cloud
- Helios
- Instinct
- Wafer Scale Engine
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →