GB300
PulseAugur coverage of GB300 — every cluster mentioning GB300 across labs, papers, and developer communities, ranked by signal.
- 2026-07-23 product_launch NVIDIA partner Wistron opened a new plant in Texas to manufacture GB300 chips. 来源
9 天有情绪数据
-
OpenAI 发布 Jalapeño 推理芯片,挑战 NVIDIA 的主导地位
OpenAI 披露了其定制推理芯片(代号 Jalapeño)的细节,据报道,与 NVIDIA 的 Blackwell 和 Rubin 系列系统相比,该芯片在效率和延迟方面有了显著提升。该芯片专为 OpenAI 的自有基础设施设计,声称在实际模型工作负载中,每瓦特性能提升 1.5–1.9 倍,延迟降低 1.7–3.6 倍。值得注意的是,OpenAI 利用其自身的 AI 模型 GPT-Astra 和 Codex 来协助编写和优化芯片的底层…
-
OpenAI 自研“jalapeño”芯片基准测试显示其性能超越 NVIDIA 硬件
OpenAI 发布了其代号为“jalapeño”的定制推理芯片的基准测试结果,该芯片是与博通(Broadcom)合作开发的。据报道,该芯片在每千瓦吞吐量和端到端延迟方面优于 NVIDIA 的 GB300 和 GB200 系统,尤其是在运行 GPT-OSS 120B 等 OpenAI 自有模型时。这种集成的系统方法,结合了硬件、内存、网络和推理软件,旨在减少数据移动和延迟,这对于代理式 AI 应用至关重要。虽然该芯片不用于训练,且 NV…
-
OpenAI 的 Jalapeño ASIC 基准测试显示性能优于英伟达 GPU
OpenAI 与 Broadcom 合作开发了自己的 700W 推理 ASIC,代号为 Jalapeño。OpenAI 发布的基准测试表明,Jalapeño 在每千瓦吞吐量和延迟方面优于英伟达的 GB200 和 GB300 GPU,特别是在 GPT-OSS 120B 和 Moonshot AI 的 Kimi K2.5 等开源模型上。该公司计划今年晚些时候在其自己的数据中心部署这些芯片,随着规模的扩大,可能会影响高带宽内存 (HBM) 供应链。
-
OpenAI 的 Jalapeño 芯片在推理性能上优于 Nvidia
OpenAI 公布了其定制设计的“Jalapeño”推理芯片的初步性能数据,展示了在速度和能效方面的显著提升。基准测试表明,Jalapeño 在吞吐量和延迟等关键指标上优于 Nvidia 的 Blackwell 和 GB200/GB300 等竞争对手。该芯片在 Broadcom 的合作下,并借助 AI 辅助开发,旨在优化 AI 推理工作负载,并计划部署在 OpenAI 的基础设施中。
-
SemiAnalysis 发布 AgentX 数据集以用于代理推理
SemiAnalysis 发布了 AgentX,这是一个开源数据集,专为代理推理设计,具有 100 万个 token 的上下文长度和多轮对话能力。该数据集旨在测试 CUDA 在代理推理场景中的主导地位的韧性。它还强调了 GB300 NVL72、MI355 和 Nvidia B200 等硬件配置,表明这些对于此类高级推理任务是相关的。
-
Nvidia 售价 10 万美元的 GB300 超级芯片 DGX Station 在线标价
Nvidia 全新 DGX Station 桌面服务器已在线标价近 10 万美元,该服务器由 GB300 超级芯片驱动。这款高性能机器配备了 Blackwell Ultra GPU,拥有 252GB HBM3e 内存和 72 核 Arm 架构的 Grace CPU,提供高达 748GB 的统一内存,用于本地人工智能模型的微调和部署。尽管在 Computex 2026 上正式发布,但最初并未披露价格,Exxact 网站上 94,930 …
-
NVIDIA 以独特的许可协议聘用 109 名 Poolside AI 员工
Poolside,一家以其 AI 模型工厂而闻名的公司,在 NVIDIA 和其创始人 Jensen Huang 的参与下发生了重大转变。与传统的收购不同,NVIDIA 获得了 Poolside 的技术许可,并聘用了其 109 名员工,为创始人及员工提供了巨额报酬。此前 Poolside 未能获得 20 亿美元的融资,以购买用于大型 GB300 GPU 集群,这凸显了开发前沿 AI 模型所需的巨额资本和基础设施。该公司创始人正在转向新的…
-
OpenAI 的 Jalapeño 芯片声称效率提升;智能体系统演进
OpenAI 发布了其定制推理芯片 Jalapeño 的基准测试细节,声称与英伟达的 GB200 和 GB300 系统相比,在效率和延迟方面有显著提升。该芯片据称提供更高的每瓦性能和更低的延迟,预计将于年底部署。同时,智能体框架(agent harnesses)和记忆系统正演变为一等组件,新的研究和开源项目专注于结构化智能体优化、持久化智能体和企业级基础设施。这一转变表明智能体系统正朝着更强大、更适应性的方向发展,框架设计与模型选择同等重要。
-
SpaceX 计划 2027 年大规模数据中心扩张,由 AI 推理利润驱动 · 追踪 5 个来源
SemiAnalysis 报道称,SpaceX 计划在 2027 年建设 6-8GW 的增量数据中心,可能超过 10GW,并有望实现每年 3000 亿美元的经常性收入。这项雄心勃勃的扩张得益于 AI 推理的高盈利能力,像 OpenAI 和 Anthropic 这样的公司每年每个 GW 可以产生超过 1000 亿美元的收入。微软也是一个关键参与者,在过去八个月中增加了 10GW 的容量,并受益于直接访问 OpenAI 模型而无需收入分成…
-
CoreWeave 签署 2029 年 A100 GPU 合同,证明旧款 AI 硬件的价值
CoreWeave 是一家专注于 AI 基础设施的云服务提供商,已签署一份直至 2029 年的 NVIDIA A100 GPU 合同,证明了旧款 AI 硬件的持续盈利能力。尽管人们担心 GPU 会迅速过时,但 CoreWeave 的首席执行官强调,这些上一代 GPU 的定价仍然坚挺。这种长寿部分归因于遗留数据中心的供电和散热限制,这使得部署像 NVIDIA 的 Blackwell 架构这样更新、更耗电的 GPU 变得困难,从而使旧款硬件保持需求。
-
NVIDIA DGX Station 提供强大的 Linux AI 处理能力
NVIDIA 的 DGX Station 搭载其 Grace CPU 和 Blackwell GPU,提供强大的本地 AI 处理能力。这款机器外观与 Apple Mac Pro 相似,目前仅支持 Linux 操作系统。它专为密集型 AI 任务设计,拥有大容量内存和先进的 GPU 架构。
-
Attn-QAT 实现了 LLM 稳定的4位注意力训练
研究人员开发了 Attn-QAT,一种用于大型语言模型注意力机制的4位量化感知训练的新颖方法。该方法解决了 FP4 计算中低精度带来的挑战,特别是对于对动态范围限制敏感的注意力分数。Attn-QAT 通过匹配反向传播中的低精度重计算并解决梯度计算中隐含的精度假设,提高了训练稳定性,在没有显式异常值缓解的情况下达到了与更高精度相当的质量。
-
NVIDIA:AI集群性能取决于配置,而非仅硬件
NVIDIA强调,使用其H100、GB200或GB300系统的相同AI集群,在吞吐量上可能表现出显著差异。该公司的分析表明,特定的配置选择对性能的影响比单纯选择硬件组件更大。
-
美国指控中国的月之暗面人工智能窃取Anthropic模型技术
美国政府指控中国人工智能公司月之暗面人工智能(Moonshot AI)窃取Anthropic的Claude Fable-5模型的专有技术,以开发其Kimi K3系统。官员们声称月之暗面人工智能构建了一个秘密提炼美国模型的平台,并使用了配备NVIDIA GB300芯片的服务器,可能规避了出口管制。美国财政部正在考虑制裁,理由是在中国模型上发现了与美国大型语言模型相匹配的水印。
-
NVIDIA 敦促 AI 模型协同设计以提高 GPU 利用率
NVIDIA 发布了一篇技术博客文章,强调了 AI 模型设计中的一个关键问题:由于模型未针对 GPU 架构进行优化,导致硬件利用率低下。文章解释了“算力强度”等概念的重要性,当模型设计采用低效的矩阵形状或维度时,GPU 会花费更多时间等待数据而非计算,从而导致利用率低下。NVIDIA 建议采用协同设计方法,模型设计者从一开始就考虑 GPU 规格,如瓦片大小和低精度格式,以最大限度地提高性能并降低成本。
-
NVIDIA合作伙伴纬创资通在德州开设GB300芯片生产厂
NVIDIA的合作伙伴纬创资通在德州沃斯堡开设了一个新的、占地32.4万平方英尺的制造工厂。该工厂将生产NVIDIA的GB300芯片,创造约500个就业岗位。该工厂代表了对该地区7亿美元的投资承诺。
-
美国财政部考虑因涉嫌窃取AI模型知识产权而实施制裁
美国财政部正考虑对中国AI公司Moonshot实施制裁,指控其不当窃取了Anthropic的Fable模型。白宫官员提出的这一指控表明,Moonshot可能通过在泰国使用受限的NVIDIA硬件进行训练,侵犯了美国的知识产权和出口管制规定。尽管模型蒸馏是一种常见的AI技术,但华盛顿方面对中国开源模型可能存在的知识产权盗窃和国家安全风险日益担忧。
-
GMI Cloud 在 2026 世界人工智能大会上发布全栈 AI 解决方案
GMI Cloud 在 2026 世界人工智能大会上展示了其全面的 AI 基础设施解决方案,重点介绍了其 AI Cloud、MaaS 和 Agentbox 平台。作为 NVIDIA 云合作伙伴,GMI Cloud 提供由 GB300 和 GB200 等高性能芯片驱动的 GPU 云服务,并在台北设有著名的“AI Factory”集群。该公司还展示了用于资源管理的 Cluster Engine、用于模型访问的 Inference Engi…
-
SemiAnalysis称Kimi K3模型的规模和效率将提振AI硬件需求
SemiAnalysis认为,尽管Kimi K3模型采用了线性注意力和较低的KV缓存需求,但它对NVIDIA和更广泛的AI硬件生态系统是有益的。该模型拥有庞大的2.8万亿参数,需要大规模的基础设施,包括NVL72等专用机架,其WideEP优化虽然增加了网络带宽需求,但却是为这类系统设计的。此外,杰文斯悖论表明,AI效率的提高最终将导致更广泛的应用,从而增加对GPU、HBM、DRAM和网络基础设施的需求。
-
NVIDIA 的 VR NVL72 系统采用无缆设计,配备 Rubin GPU
SemiAnalysis 对 NVIDIA 即将推出的 VR NVL72 系统进行了详细分解,重点介绍了与 GB200 等先前架构相比的重大设计变更。关键创新包括无缆计算托盘设计,用 Paladin HD2 板对板连接器取代传统连接器,以提高可靠性并缩短组装时间。该系统使用 Strata 模块,每个模块包含两个 Nvidia Rubin GPU 和一个 Vera CPU,并配有可插拔的 LPDDR5X 内存。