Anyscale 为其 Ray 框架引入了 NVLink 域感知放置组,旨在优化 NVIDIA GB300 NVL72 系统的性能。这些新的放置组确保紧密耦合的 actor 被调度在同一个 NVLink 域内,NVLink 域是一个连接 72 个 NVIDIA Blackwell GPU 和 36 个 NVIDIA Grace CPU 的机架级互连。这种拓扑感知调度原语旨在最大化 GPU 通信并保留系统意图,它建立在先前节点级放置策略的基础上。 AI
影响 增强了在专用 NVIDIA 硬件上进行大规模 AI 训练的性能。
排序理由 这是用于优化硬件的软件功能更新,并非新的模型发布或重大的行业事件。
- Anyscale
- Blackwell GPUs
- DGX H200
- GB200
- GB300 NVL72
- Grace CPUs
- Hopper
- NVIDIA
- NVIDIA DGX H100
- NVLink
- NVLink Domain
- NVLink Domain-Aware Placement Groups
- Ray
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →