Rubin ultra
PulseAugur coverage of Rubin ultra — every cluster mentioning Rubin ultra across labs, papers, and developer communities, ranked by signal.
- instance of Nvidia Rubin Gpu 95%
- used by High Bandwidth Memory 90%
- used by Hbm4 90%
- developed SemiAnalysis 90%
- used by Hbm4e 90%
- developed Kyber NVL144 90%
- developed by Kyber NVL144 90%
- affiliated with High Bandwidth Memory 70%
- developed by Hbm4e 70%
- developed by Hbm4 70%
- used by polytetrafluoroethylene 70%
- affiliated with Nvidia Rubin Gpu 70%
7 天有情绪数据
-
英伟达发布Rubin Ultra GPU;GPT-6 Astra或将使用循环Transformer
英伟达预览了其Rubin Ultra GPU,该GPU每封装配备1TB高带宽内存。另外,有报道称OpenAI即将推出的GPT-6 Astra模型将采用循环Transformer,使其能够通过多次处理层而不是增加参数数量来增加计算深度。这种架构转变表明领先的AI实验室在模型扩展方法上可能发生变化,重点将放在计算效率而非模型规模上。
-
NVIDIA Rubin Ultra GPU 预览版拥有 1TB HBM 是出于供应原因,而非性能考量
SemiAnalysis 讨论了 NVIDIA 的 Rubin Ultra GPU,重点介绍了一个预览版,该预览版每封装拥有 1TB 高带宽内存 (HBM),远超目前出货产品中的 192GB。Myron Xie 和 Jordan Nanos 的对话表明,这种差异主要是由于供应限制,而非性能限制。Xie 解释了 4-High (4-HI) 堆叠方法如何增加每个晶圆可用的芯片数量,并指出对内存需求减少的讽刺之处在于,它来自于研究实验室本身…
-
NVIDIA 的 Rubin 和 Feynman 芯片将解锁大规模 AI 扩展
NVIDIA 即将推出的 Blackwell 和 Rubin 芯片架构有望显著加速 AI 的发展,其中 Rubin 预计将为某些模型的训练 GPU 减少 4 倍,并将推理成本降低 10 倍。Rubin Ultra 计划于 2027 年底推出,它将把 576 个 GPU 连接到一个 NVLink 域中,从而为 AI 研究和部署提供前所未有的规模。随着 2028 年 Feynman 架构的推出,预计将取得进一步的进展,该架构将拥有更大规模…
-
英伟达削减Rubin Ultra HBM堆叠以提高AI推理成本效益
据报道,英伟达已调整其即将推出的Rubin Ultra GPU的规格,将高带宽内存(HBM)从12堆叠(12-Hi)减少到8堆叠(8-Hi)。这一变化是由于认识到AI推理的主要瓶颈是每美元的带宽,而不是每美元的容量。通过减少HBM堆叠的数量,英伟达可以减少受供应限制的DRAM芯片,同时保持甚至提高带宽,从而提高对带宽密集型AI工作负载的成本效益。
-
英伟达因成本飙升削减Rubin Ultra的HBM · 追踪3个来源
英伟达已为其Rubin Ultra系统减少了高带宽内存(HBM)配置,从HBM4E 12-Hi(384GB)降级到HBM4 8-Hi(192GB)。这一决定源于近期HBM和DRAM的价格上涨,导致内存约占总资本成本的40%。通过“削减规格”,英伟达旨在削减超过50%的成本,并将资本重新分配给网络基础设施,例如用于机架间互连的扩展网络。
-
亚马逊将英伟达GPU订单增至三倍,为满足AI需求增购200万颗芯片 · 追踪4个来源
亚马逊已显著扩大与英伟达的合作关系,同意为其AWS数据中心额外采购200万颗英伟达GPU芯片。这些芯片,包括Blackwell Ultra、Rubin和Rubin Ultra型号,计划于2027年和2028年交付。此交易使亚马逊的先前订单增至三倍,并反映了各行业对AI计算能力日益增长的需求。此次扩大的合作还涉及将英伟达的网络硬件、软件和机器人平台集成到AWS中,尽管亚马逊仍在继续开发自己的竞争性AI芯片。
-
AWS和NVIDIA扩大合作,承诺再采购200万块GPU
AWS和NVIDIA正在显著扩大其合作伙伴关系,承诺到2027-2028年间在其全球基础设施中部署额外的200万块NVIDIA GPU。此次扩展包括Blackwell Ultra、Rubin和Rubin Ultra等下一代GPU平台,并超越GPU本身,涵盖NVIDIA的Vera CPU基础设施以及具有定制高带宽内存的NVLink Fusion的进步。此次合作旨在满足日益增长的人工智能计算需求,特别是针对智能体AI、科学发现、物理AI和…
-
Nvidia Rubin Ultra GPU 面临 HBM 降级,容量从 1TB 削减至 192GB
据报道,Nvidia 即将推出的 Rubin Ultra GPU 的高带宽内存 (HBM) 容量已大幅削减。初步预览显示为 1TB HBM,但量产版本预计将配备 192GB HBM4,这一容量低于标准 Rubin GPU 的 288GB。此次降级归因于堆叠内存芯片数量的变化、堆叠高度的降低,以及转向容量较低的 HBM4 芯片而非 HBM4E。
-
据报道,NVIDIA 正在测试采用更低显存的 Rubin Ultra GPU,以应对 HBM 短缺
据报道,NVIDIA 正在探索其 Rubin Ultra GPU 的配置方案,可能会将显存容量降低至 192 GB。此举正值高带宽内存(HBM)持续短缺之际,而 HBM 对先进的 AI 加速器至关重要。该公司还在考虑在这些配置中回退到使用 HBM4 内存技术。
-
英伟达据称正测试低内存Rubin Ultra,因HBM短缺
据报道,由于预计将出现高带宽内存(HBM)短缺,英伟达正在为其即将推出的Rubin Ultra加速器探索降低内存配置的方案。目前正在测试的方案内存容量低至192 GB,相较于此前宣布的1 TB HBM4E有大幅下降。此举可能还涉及从更先进的HBM4E回退到HBM4,因为HBM4E面临供应链复杂性问题。该公司表示其路线图保持不变,但有报道称可能出现延迟,并且正在持续测试各种内存容量和配置。
-
软银第一季度利润不及预期,因AI办公领域投资
软银集团公布其2027财年第一季度净利润为1500.7亿日元,略低于市场预期。公司维持了其全年净销售额、营业利润和净利润的预测。相关消息方面,TrendForce报告称DRAM短缺预计将持续到2027年,NVIDIA因HBM4e验证可能延迟,正在评估其Rubin Ultra的不同HBM配置。此外,阿里巴巴、字节跳动和腾讯等其他科技巨头据报道正在大力投资AI办公解决方案。
-
英伟达因DRAM短缺担忧重新评估Rubin Ultra HBM配置
由于预计DRAM短缺将持续到2027年,英伟达(NVIDIA)正在重新评估其即将推出的Rubin Ultra GPU的高带宽内存(HBM)配置。该公司正在考虑较低的HBM配置,包括HBM4e 8hi和HBM4变体,因为HBM4e 12hi的验证进展面临不确定性。其他云服务提供商也在为其下一代定制ASIC考虑这一战略转变,这反映了行业对内存供应的广泛担忧。
-
Nvidia 的 Kyber NVL144 AI 服务器机架因制造问题推迟至 2028 年
据报道,Nvidia 即将推出的 Kyber NVL144 AI 服务器机架已推迟一年多,由于电路板制造问题,其发布时间现预计在 2028 年。更先进的 Rubin Ultra 版本也被取消了。这些挫折可能会为 AMD 和 Google 等竞争对手提供获得市场份额的机会,因为亚洲供应商的市场价值已大幅下跌。
-
NVIDIA AI服务器需求800V供电升级
NVIDIA的AI服务器电力需求正在增长,这需要向800V高压直流供电系统转变。这种演变是由从Vera Rubin到Rubin Ultra服务器架构的进步驱动的,突显了先进AI日益增长的基础设施需求。
-
NVIDIA AI基础设施路线图遭遇重大延误和取消
NVIDIA在其高性能计算基础设施方面正面临重大的延误和取消,影响了其AI加速器路线图。由于其PCB中板的制造挑战,Kyber NVL144机架架构已推迟至2028年,NVL576配置也可能延迟。此外,NVIDIA提出的NVL72x2背靠背机架架构在受到超大规模用户反对后已被取消。4计算芯片的Rubin Ultra的取消,只留下性能较弱的2计算芯片版本,这可能为AMD和TPUv8i Broadfly等竞争对手打开市场份额增长的大门。
-
据报道,Nvidia 因制造问题取消雄心勃勃的四芯片 Rubin Ultra GPU
据报道,Nvidia 已因制造挑战取消了原计划于 2027 年推出的雄心勃勃的四芯片 Rubin Ultra GPU。据称,该公司将选择更易于生产的双 GPU 设计。这一变化可能导致加速器的性能不如最初计划,可能影响其与 AMD Instinct MI500 系列等竞争对手的竞争力。
-
英伟达市场份额因竞争对手和芯片生产问题而受到侵蚀
据报道,英伟达的市场份额正被 Trainium、TPU 和 AMD 芯片等竞争对手侵蚀,影响了其在 AI 加速器市场的统治地位。这种侵蚀部分是由于制造执行问题,导致其在 GTC 2026 发布三个月后取消了 4 die Rubin Ultra 芯片。新的、更小的“Rubin Ultra”预计性能将远低于最初的设计。
-
英伟达为Vera Rubin开发800V Power Rack,长园科技面临电感器不确定性
英伟达正在开发一款800V高压直流(HVDC)Power Rack解决方案,目标是在2026年第三季度为Vera Rubin客户完成交付。预计在2027年末,随着Rubin Ultra系列的推出,这种新的电源架构将获得更广泛的应用,并有望在2028年实现大规模部署。与此同时,长园科技的芯片电感器产品正处于验证和小批量出货阶段,尚未带来显著营收贡献,未来业务前景尚不明朗。
-
A股市场在人工智能波动中出现风格轮动争论
A股市场正经历微妙变化,人工智能科技股呈现高波动性和内部分化加剧。与此同时,银行、证券、电力等传统蓝筹板块显现复苏迹象,部分龙头股创下新高。这引发了私募机构关于这究竟是短暂轮动还是系统性风格转换的争论,部分机构已开始评估拥挤的人工智能交易的风险。
-
中信证券:高速计算推动PTFE需求增长
中信证券报告称,高频高速算力需求正快速增长,预示着电子级聚四氟乙烯(PTFE)有望获得广泛应用。该材料具有热稳定性好、介电性能优异等特性,适用于严苛的应用场景。预计在军事、高速服务器线缆和高速板卡等领域将迎来增长,NVIDIA即将推出的Rubin Ultra服务器可能在其背板中使用PTFE,标志着PTFE下游应用的新定义。