PulseAugur
中
实时 07:03:42
实体 Groq LPU

Groq LPU

PulseAugur coverage of Groq LPU — every cluster mentioning Groq LPU across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. RESEARCH · CL_257949 ·

    Piecemakers 押注定制 DRAM 用于边缘 AI,与 HBM 区分开来

    由南亚科技支持的 DRAM 设计公司 Piecemakers Technology, Inc. 正在专注于为边缘 AI 设备提供定制内存解决方案,而不是高带宽内存 (HBM)。该公司认为推理内存需求将与训练内存需求不同,并提出了一种通过混合键合将 DRAM 直接堆叠到处理器上的解决方案。这一战略体现在其收入模式中,该模式优先考虑设计费而非芯片销售,定制 AI 设计工作占其收入的很大一部分。Piecemakers 旨在到 2027 年转…

  2. COMMENTARY · CL_215686 ·

    AI 芯片架构日益多样化以满足计算需求 · 跟踪 1 个来源

    自 2018 年以来,随着传统 CPU 性能的停滞,AI 芯片领域出现了领域特定架构(DSA)的“寒武纪大爆发”。这些新架构,包括 GPU、TPU、LPU 和晶圆级引擎,主要侧重于加速 AI 计算,特别是训练和推理所需的矩阵乘法。NVIDIA 和 AMD 等主要参与者表现突出,OpenAI 和 Anthropic 等主要 AI 实验室也做出了重大承诺。这些芯片的核心挑战在于通过有效地将数据移动到计算单元来克服“内存墙”,因为计算能力已…

  3. RESEARCH · CL_196369 ·

    AMD收购Taalas,推动专用AI推理芯片

    AMD已收购加拿大AI推理芯片公司Taalas,将其专用硬件整合到AMD的加速器路线图中。Taalas专注于创建针对特定AI模型的优化芯片,旨在通过将模型权重硬编码到硬件中来降低推理成本并提高响应时间。这种方法牺牲了灵活性以换取效率,其首款芯片HC1专为Llama 3.1 8B设计,实现了高令牌生成速度。该策略的成功取决于所选模型是否具有足够且持续的使用量来证明定制成本的合理性,这是一个挑战,因为AI模型仍在快速发展。

  4. COMMENTARY · CL_191514 ·

    NVIDIA 的 TileRT InferenceX 受到专用 AI 硬件的挑战

    SemiAnalysis 正在质疑 NVIDIA 的 TileRT InferenceX 软件在其 GPU 上运行是否能与 Cerebras、Groq 和 SambaNova 等公司的专用 AI 硬件竞争。该软件专为批处理大小为 1 的超高交互性而设计,具有分离式引擎,可实现高吞吐量的预填充和高交互性的解码。