Vera Rubin NVL72
PulseAugur coverage of Vera Rubin NVL72 — every cluster mentioning Vera Rubin NVL72 across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
马斯克的 SpaceX、xAI 将独家使用英伟达 GPU,发射太空优化 AI 硬件
埃隆·马斯克宣布 SpaceX 和 xAI 将独家使用英伟达 GPU,并称 Vera Rubin NVL72 架构是目前最好的。这一决定将使 AMD、Cerebras 等竞争对手在商用 AI 加速器市场上处于不利地位。SpaceX 计划从明年开始将 NVL72 系统的优化版本(称为 Starmind)部署到太空,此举极大地扩展了英伟达自身的太空 AI 硬件计划。
-
英伟达的 Vera Rubin NVL72 与 GB200 NVL72 在新分析中对决
SemiAnalysis 发布了一项分析,比较了英伟达的 Vera Rubin NVL72 和 Blackwell GB200 NVL72 系统。比较侧重于推理总拥有成本和架构差异,包括 Rubin 的基于 LUT 的 Tensor Core、每兆瓦性能、每美元性能以及软件改进。分析还涉及 Rubin、PyTorch、vLLM 和 OpenAI Triton 的公开软件发布。
-
NVIDIA Vera Rubin NVL72 vs GB200 NVL72:成本和架构分析
SemiAnalysis 发布了一份分析报告,将 NVIDIA 的 Vera Rubin NVL72 与 GB200 NVL72 进行比较,重点关注推理的总拥有成本和架构差异。该分析强调了 Rubin 基于查找表(LUT)的张量核心及其对每兆瓦和每美元性能的影响。报告还详细介绍了软件改进,包括公共 Rubin 软件及其与 PyTorch 和 vLLM 的兼容性,并提到了 OpenAI Triton。
-
Nvidia 展示 Vera Rubin NVL72 机架运行 OpenAI 工作负载
Nvidia 独家展示了其工程超级实验室的内部情况,展示了 Vera Rubin NVL72 机架系统的运行。该实验室位于 Nvidia 总部附近,旨在让工程师测试和演示新硬件,包括 Vera CPU 及其与下一代 AI 平台的集成。实验室展示了运行 OpenAI 工作负载的机架,特别提到了 GPT‑Rosalind 模型,并演示了 800VDC 等先进的供电系统。
-
NVIDIA Vera Rubin平台全球扩展,提升AI工厂效率 · 追踪4个来源
NVIDIA宣布其专为大规模AI工厂设计的Vera Rubin平台已在全球范围内扩展并加速部署。该系统通过七个芯片和五个机架托盘的极端协同设计构建,旨在提供高能效比和最低的代币成本。CoreWeave等合作伙伴的早期基准测试显示,与前几代相比,吞吐量有了显著提升。Vera Rubin平台正在被主要云服务提供商部署,并为欧洲新的AI基础设施项目提供支持,包括与Microsoft和Mistral的合作。
-
NVIDIA 的 VR NVL72 系统采用无缆设计,配备 Rubin GPU
SemiAnalysis 对 NVIDIA 即将推出的 VR NVL72 系统进行了详细分解,重点介绍了与 GB200 等先前架构相比的重大设计变更。关键创新包括无缆计算托盘设计,用 Paladin HD2 板对板连接器取代传统连接器,以提高可靠性并缩短组装时间。该系统使用 Strata 模块,每个模块包含两个 Nvidia Rubin GPU 和一个 Vera CPU,并配有可插拔的 LPDDR5X 内存。
-
Nvidia Rubin GPU 承诺提供 10 倍更便宜的 Token,但存在重大隐忧
Nvidia 发布了其 Vera Rubin NVL72 GPU,承诺与 Blackwell 架构相比,每个 Token 的成本可降低高达 10 倍。然而,这种显著的成本节省取决于几个因素,包括使用新的 NVFP4 格式和特定的专家混合模型,并且基准测试是在完整机架规模下进行的。实际部署时间也带来了挑战,因为该硬件计划于 2026 年下半年发货,广泛可用性将延长至 2027 年,这可能与即时预算规划不符。
-
每瓦特令牌数将决定 2026 年 GPU 和散热方案
2026 年 AI 计算的主要瓶颈将从原始处理能力转向效率,特别是每瓦特令牌数。这是因为推理(目前占 AI 计算支出的绝大部分)本质上是一个功耗受限的问题,尤其是在数据中心功耗分配固定的情况下。因此,能够最大化每兆瓦特生成令牌数的最高效 GPU 将比那些拥有最高 FLOPS 的 GPU 更受青睐。服务软件和数值精度(如 FP8 和 FP4)的进步可以在不要求新硬件的情况下显著降低每令牌成本,提供比仅购买更多 GPU 更直接、更具成本效…
-
Supermicro 发布用于 AI 服务器机架的高阻抗冷却剂
Supermicro 发布了一种专为其 AI 服务器机架(包括即将推出的 Vera Rubin NVL72)设计的新型液体冷却剂。这种新型冷却剂的电气阻抗比标准冷却剂高 1,000 倍,Supermicro 声称这将显著降低因轻微泄漏导致系统关闭或组件损坏的风险。尽管具体的技术细节尚未披露,但该公司声称这一特性对于保护昂贵的 AI 硬件和最大限度地减少数据中心的停机时间至关重要。
-
NVIDIA GTC Taipei:Vera Rubin NVL72 和 Jetson Thor 引领 AI 硬件展示
NVIDIA 在 GTC Taipei 上展示了其最新的 AI 创新,包括荣获多个最佳选择奖的 Vera Rubin NVL72 AI 超级计算机。该系统专为大规模 AI 推理和训练而设计,可提供显著的性能和效率提升。此外,NVIDIA 还重点介绍了面向边缘 AI 和机器人技术的 Jetson Thor 平台,强调其在生成式 AI 应用方面增强的功能。