Nvidia GB200
PulseAugur coverage of Nvidia GB200 — every cluster mentioning Nvidia GB200 across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
新的 FlashAttention-4 方法在 Blackwell 硬件上提升了 FP4 性能
研究人员开发了一种名为 Direct-P 的新方法,用于优化 FlashAttention-4 在 Blackwell 的 4 位浮点 (FP4) 张量核心上的性能,解决了由 softmax 转换和片上依赖引起的性能瓶颈。对于非因果推理,Direct-P 将分数直接映射到 FP4 概率,在 NVIDIA GB200 硬件上实现了高达 bfloat16 2.13 倍的吞吐量。因果训练路径通过 FP8 梯度操作数重建概率,将 80 亿参数…
-
OpenAI 发布用于推理工作负载的定制 Jalapeño ASIC
OpenAI 与 Broadcom 合作开发了名为 Jalapeño 的自研推理 ASIC。这款定制芯片旨在为 OpenAI 的推理工作负载提供最佳计算平台,专注于每瓦性能和低延迟。Jalapeño ASIC 旨在超越当前行业领导者如 NVIDIA 的 GB200 和 GB300,尤其是在多芯片操作的能效和降低延迟方面。
-
LTX-2.5 开放世界模型支持在 NVIDIA GPU 上进行本地 AI 视频制作
一款新的开放权重世界模型 LTX-2.5 已发布,它使创作者能够在本地 NVIDIA RTX GPU 上执行视频生成和其他 AI 任务。该模型显著降低了 VRAM 要求,使得先进的视频制作在桌面硬件上即可实现。与现有的闭源替代品相比,LTX-2.5 提供了更高的稳定性和速度,能够快速迭代和批量生成内容,无需支付云服务费用。
-
MiniMax H3 模型通过 Sol Engine 实现重大速度提升
MiniMax AI 宣布使用 Sol Engine 显著提高了其 MiniMax H3 模型的速度。这款原生于代理的 Sol Video Inference Engine 比 Diffusers 快 3.95 倍,比 SGLang 快 2.80 倍。该引擎通过处理 8 个 Nvidia GB200 单元,在 1344x768 分辨率和 24 FPS 下处理 124 帧,展示了其能力。
-
法国借助英伟达加速人工智能基础设施建设,Mistral AI 建立数据中心 · 跟踪 1 个来源
法国正在显著推进其人工智能基础设施和生态系统,大量投资和新设施正在投入使用。Mistral AI 正在法国建立一个大型数据中心,利用英伟达的 GB200 系统并计划建设广泛的欧洲计算能力。其他举措包括 Scaleway 提供英伟达 Blackwell 实例,以及 Bull/Foxconn 在欧洲生产英伟达 Vera Rubin NVL72 系统。该国还通过针对欧洲语言和监管需求的开放模型,在公司如 Pleias 和英伟达 Nemotr…
-
美国关闭中国企业在海外购买先进AI芯片的漏洞
美国商务部工业与安全局(BIS)已关闭了一个允许中国在华外子公司获取先进AI芯片的漏洞。此前,马来西亚等国的公司可以合法购买这些芯片,导致数十万枚先进AI芯片可能被转移。此举旨在加强出口管制,防止中国通过间接渠道获取尖端AI硬件。