PulseAugur
实时 20:16:58

Anyscale Ray 优化 NVIDIA GB300 NVL72 的 NVLink 域放置

Anyscale 为其 Ray 框架引入了 NVLink 域感知放置组,旨在优化 NVIDIA GB300 NVL72 系统的性能。这些新的放置组确保紧密耦合的 actor 被调度在同一个 NVLink 域内,NVLink 域是一个连接 72 个 NVIDIA Blackwell GPU 和 36 个 NVIDIA Grace CPU 的机架级互连。这种拓扑感知调度原语旨在最大化 GPU 通信并保留系统意图,它建立在先前节点级放置策略的基础上。 AI

影响 增强了在专用 NVIDIA 硬件上进行大规模 AI 训练的性能。

排序理由 这是用于优化硬件的软件功能更新,并非新的模型发布或重大的行业事件。

在 Anyscale blog 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Anyscale Ray 优化 NVIDIA GB300 NVL72 的 NVLink 域放置

报道来源 [1]

  1. Anyscale blog TIER_1 English(EN) ·

    Maximizing the Power of NVIDIA GB300 NVL72: NVLink Domain-Aware Placement Groups in Ray

    Optimize Ray performance on NVIDIA GB300 NVL72 with new NVLink Domain-Aware Placement Groups, enabling topology-aware scheduling for multi-node GPU clusters