Blackwell
PulseAugur coverage of Blackwell — every cluster mentioning Blackwell across labs, papers, and developer communities, ranked by signal.
- instance of Nvidia Rubin Gpu 90%
- instance of Nvidia RTX 50 series 90%
- instance of Nvidia GeForce RTX 5070 Ti 90%
- instance of GDDR7 SDRAM 90%
- instance of Nvidia RTX 5060 Ti 90%
- instance of Newegg 90%
- developed Vera Rubin NVL72 90%
- instance of GeForce 50 series 90%
- instance of Nvidia RTX Pro 6000 Blackwell Workstation Edition 90%
- used by Arm Holdings 90%
- uses RTX Spark 90%
- competes with jalapeño 80%
9 天有情绪数据
Blackwell performance will be benchmarked against Jalapeño within 60 days
With OpenAI's Jalapeño chip now revealed and positioned as a direct competitor to NVIDIA's Blackwell, it is highly probable that independent benchmarks comparing the two will emerge. These benchmarks will be crucial for verifying OpenAI's performance claims and assessing the true competitive landscape.
OpenAI's Jalapeño chip to achieve >1.9 exaFLOPS in specific workloads
OpenAI's Jalapeño chip is claimed to offer 1.5-1.9x more work per watt and 1.7-3.6x lower latency. If these figures hold true for specific, optimized workloads, the chip could effectively surpass the 1.7 exaFLOPS mentioned in other reports, especially when considering its inference focus.
OpenAI leverages its own AI models for chip development
The report indicates that OpenAI used its GPT-Astra and Codex models to aid in writing and optimizing the low-level kernels for the Jalapeño chip. This suggests a growing trend of AI-assisted hardware design and development within leading AI labs.
-
软件优化为AI数据中心电力需求提供关键解决方案
研究人员强调,软件优化是解决AI数据中心日益增长的电力需求的关??键解决方案,预计到2030年,AI数据中心的用电量将与日本相当。专家建议,除了关注硬件效率外,改进系统软件、算法和应用程序也能带来显著的节能效果。诸如在推理中使用较低精度格式、优化模型训练过程以及智能管理计算资源等技术,可以在不牺牲性能或硬件的情况下,将能耗降低高达30%。
-
AI数据中心加剧电网稳定性挑战,亟需芯片到电网协同设计
AI数据中心因能源需求快速且不可预测的波动,正导致电网稳定性面临严峻挑战。这要求芯片制造商、数据中心运营商和公用事业公司采取协同方法来管理这些电力波动。Nvidia等公司正在开发机架级存储和控制等解决方案来缓解这些问题,而Oracle则专注于现场发电,以满足AI工作负载巨大的且波动的能源需求。
-
SemiAnalysis 讨论 GPU 经济学、InferenceX 和新硬件
SemiAnalysis 讨论了 GPU 的经济学,其中 InferenceX 团队分享了关于 Engram 内存卸载和 AgentX 利润计算器的见解。对话还涉及 TPU v7,Vera Rubin 与 Blackwell 架构的比较,以及更快的 token 处理的价值。此外,还强调了 TileRT 在推动 NVIDIA GPU 方面的进展,并讨论了专用芯片。
-
配备 16GB RTX 5060 Ti 的游戏 PC 降至 1,399.99 美元
一款配备 Nvidia RTX 5060 Ti 16GB GPU 的游戏 PC 现价为 1,399.99 美元,折扣为 300 美元。这款预装系统 ABS Cyclone Aqua 配备 20 核 Intel Core i7-14700F 处理器、16GB DDR5 RAM 和 1TB SSD。RTX 5060 Ti 的 16GB GDDR7 VRAM 特点使其适合 1080p 和 1440p 游戏,并支持 Nvidia 的 DLSS 技术。
-
报告:数十亿美元的英伟达AI芯片通过非法渠道流入中国 · 追踪到1个来源
来自先进国防研究中心(C4ADS)的一份报告详细说明了中国公司如何规避美国的出口限制,以获取价值数十亿美元的先进英伟达AI芯片。报告指出了三种主要方法:研究机构直接采购、通过越南等东南亚国家进行转运,以及复杂的空壳公司结构。尽管美国法规禁止向中国销售H100和A100等高端芯片,但据报道,这些芯片仍流入了中国实体手中,其中一些实体与中国共产党和国防部门有关联。走私硬件的实际数量可能远高于报告数字,估计中国相当一部分AI计算能力依赖于这…
-
NVIDIA RTX 50 系列笔记本 GPU 获得非官方功率提升工具
一位开发者创建了一个名为 NvpwrControl 的实验性工具,允许用户提高 NVIDIA RTX 50 系列笔记本 GPU 的功率限制。该工具可在 GitHub 上获取,有可能将性能提升高达 40 瓦,使 RTX 5090 移动 GPU 等 GPU 达到 225W。然而,该工具被描述为高度实验性且部分由 AI 生成,由于功率增加和热量输出增加,存在损坏笔记本电脑 GPU 的风险。它目前仅支持 Blackwell GPU,并且需要特…
-
Mod在RTX 40系列GPU上启用了Nvidia的RTX 50系列DLSS多帧生成功能
一个非官方的mod在GeForce RTX 40系列GPU上启用了Nvidia的DLSS多帧生成(MFG)功能,该功能此前是即将推出的RTX 50系列独有的。Modder dashdogy发布了该mod,并在《赛博朋克2077》等游戏中成功测试,显示出视觉流畅度的提升。虽然该mod有效,但它引入了视觉伪影,并引发了关于Nvidia新硬件营销策略的疑问。
-
Nvidia 发布 RTX Pro 5500,配备 84GB 显存,专为 AI 工作负载设计
Nvidia 推出了新款工作站显卡 RTX Pro 5500,该显卡基于与 GeForce RTX 5090 相同的 GB200 芯片。这款新显卡大幅增加了显存容量,配备了 84GB GDDR7 内存,是标准版 RTX 5090 的 2.6 倍。虽然它与 RTX 5090 共享核心规格,但其主要优势在于扩展的内存容量,将其定位在 RTX Pro 5000 和 RTX Pro 6000 型号之间。Nvidia 的这一战略举措似乎是为了填…
-
AI 硬件供应链:聚焦第三衍生物赋能者
SemiAnalysis 强调了半导体供应链中那些关键但常被忽视的“第三衍生物”公司,它们赋能了先进的 AI 硬件。这包括材料供应商,如在基板必需的 ABF 薄膜市场占据主导地位的 Ajinomoto,以及化学品公司,如在 ABF 基板的粘合促进化学品方面拥有近乎垄断地位的 MEC。分析还指出,设备制造商如 Eternal Precision Mechanics 和 Taesung,其设备对于基板生产中的多层压合和湿法工艺步骤至关重要…
-
AI芯片供应链因ABF基板瓶颈而紧张
半导体行业在高性能CPU、GPU和AI加速器必需的ABF基板供应方面面临着关键瓶颈。由于AI热潮,需求激增,Nvidia等公司仅出货数百万台依赖这些基板的AI加速器。供应链高度集中,味之素(Ajinomoto)控制着关键材料味之素积层膜(ABF)超过95%的市场份额。制造商在基板尺寸增大和层数增加以适应日益增长的复杂性方面也遇到了技术挑战,导致翘曲和良率损失等问题。行业正在探索解决方案,包括扩大ABF产能和开发玻璃基板等替代技术。
-
NVIDIA 的 Rubin 和 Feynman 芯片将解锁大规模 AI 扩展
NVIDIA 即将推出的 Blackwell 和 Rubin 芯片架构有望显著加速 AI 的发展,其中 Rubin 预计将为某些模型的训练 GPU 减少 4 倍,并将推理成本降低 10 倍。Rubin Ultra 计划于 2027 年底推出,它将把 576 个 GPU 连接到一个 NVLink 域中,从而为 AI 研究和部署提供前所未有的规模。随着 2028 年 Feynman 架构的推出,预计将取得进一步的进展,该架构将拥有更大规模…
-
Together AI 为 NVIDIA Vera Rubin Blackwell GPU 优化 ThunderKittens
Together AI 已获得基于 Blackwell 架构的 NVIDIA Vera Rubin NVL72 平台的访问权限。他们的团队已更新其 ThunderKittens 软件,以利用 Vera Rubin 芯片的新功能,特别专注于优化 NVFP4 和 FP8 GEMM(通用矩阵乘法运算)。初步测试表明,虽然新平台将张量核心的 K 维度容量翻倍并增加了张量内存,但现有的 Blackwell 优化内核无法足够快地为核心提供数据,仅…
-
新工具诊断 NVIDIA Blackwell GPU 上的大语言模型服务问题
一款名为 `blackwell-doctor` 的新工具已被开发出来,用于帮助诊断和解决在大语言模型(LLM)部署于 NVIDIA Blackwell GPU 上的服务问题。该工具系统地测试各种配置,包括不同的运行时(如 vLLM 和 SGLang)、MoE 后端、量化方法和上下文长度。它着重展示了这些设置的细微变化如何导致性能、内存使用量甚至模型稳定性方面的显著差异,并提供详细的比较,识别出解决问题行为的具体提交或标志。
-
德国骗子向两名买家出售空心RTX 5090 GPU
一名德国骗子通过向两人出售被掏空内部组件的Nvidia RTX 5090显卡,骗取了数千美元。这些显卡缺少如硅芯片和内存芯片等关键内部组件,但售价远低于市场价。骗子通过提供虚假发票和篡改序列号等手段欺骗买家,这凸显了针对高需求硬件的复杂骗局日益增多的趋势。
-
Perplexity 详解 GPU 嵌入栈,实现高效 AI 搜索
Perplexity 详细介绍了其 GPU 嵌入栈,重点关注服务其 pplx-embed 模型的基础设施。该公司工程团队强调,通过重用其 LLM 栈中的内核,他们优化了批量和在线嵌入工作负载。关键组件包括用于请求处理的 Ivy、用于调度的 Tulip 和用于模型推理的 ROSE,所有这些都旨在最大限度地提高在 Hopper 和 Blackwell 等现代 GPU 硬件上的效率。
-
Nvidia 在 PAX West 现场以建议零售价发售 RTX 50 系列 GPU
Nvidia 在 PAX West 现场以建议零售价发售创始人版 RTX 50 系列 GPU。此举此前在 QuakeCon 上也有出现,旨在直接向消费者提供 RTX 5090、RTX 5080 和 RTX 5070 等显卡。目前这些高端 GPU 的市场价格已大幅上涨,RTX 5090 在线上的标价常超过 5000 美元。
-
模组制作者解锁 RTX 40 系列 GPU 的 Nvidia DLSS 多帧生成功能
游戏模组制作者成功绕过了 Nvidia 将其 DLSS 多帧生成功能限制在较新的 RTX 50 系列 GPU 上的尝试。尽管 Nvidia 声称该功能需要仅在 RTX 50 "Blackwell" 显卡中存在的专用硬件,但模组制作者已经开发了基于软件的解决方案。这些模组利用 Nvidia 自有的 DLSS-G 框架,已被改编为 ReShade 插件,据报道可在 RTX 40 系列显卡上实现流畅的帧率,这与 Nvidia 此前关于硬件依…
-
新的 FlashAttention-4 方法在 Blackwell 硬件上提升了 FP4 性能
研究人员开发了一种名为 Direct-P 的新方法,用于优化 FlashAttention-4 在 Blackwell 的 4 位浮点 (FP4) 张量核心上的性能,解决了由 softmax 转换和片上依赖引起的性能瓶颈。对于非因果推理,Direct-P 将分数直接映射到 FP4 概率,在 NVIDIA GB200 硬件上实现了高达 bfloat16 2.13 倍的吞吐量。因果训练路径通过 FP8 梯度操作数重建概率,将 80 亿参数…
-
新的RAED方法改进了不确定性下的实验设计
研究人员推出了一种新的实验选择方法——分辨率感知实验设计(RAED),该方法考虑了持续存在的干扰不确定性。RAED旨在最小化结构候选集,同时控制虚假排除。该方法通过学习到的基于分数的实现来操作化,并在地下流动、河流和甲烷氧化基准测试中进行了测试,与传统的预期信息增益方法相比,显示出改进实验选择的潜力。
-
英伟达RTX 5090 GPU因AI需求飙升至5000美元
英伟达高端RTX 5090游戏GPU价格出现大幅上涨,部分型号现已超过5000美元,远高于其1999美元的建议零售价。此次价格飙升归因于人工智能行业的强劲需求,导致关键组件从消费品市场转移。其他RTX 50系列显卡,包括RTX 5080和RTX 5060 Ti,价格也大幅上涨,Blackwell系列平均涨幅约为建议零售价的60%。