PulseAugur
中
实时 23:35:04
实体 Nvidia GB200

Nvidia GB200

PulseAugur coverage of Nvidia GB200 — every cluster mentioning Nvidia GB200 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 6 条
  1. RESEARCH · CL_235593 ·

    新的 FlashAttention-4 方法在 Blackwell 硬件上提升了 FP4 性能

    研究人员开发了一种名为 Direct-P 的新方法,用于优化 FlashAttention-4 在 Blackwell 的 4 位浮点 (FP4) 张量核心上的性能,解决了由 softmax 转换和片上依赖引起的性能瓶颈。对于非因果推理,Direct-P 将分数直接映射到 FP4 概率,在 NVIDIA GB200 硬件上实现了高达 bfloat16 2.13 倍的吞吐量。因果训练路径通过 FP8 梯度操作数重建概率,将 80 亿参数…

  2. SIGNIFICANT · CL_220020 ·

    OpenAI 发布用于推理工作负载的定制 Jalapeño ASIC

    OpenAI 与 Broadcom 合作开发了名为 Jalapeño 的自研推理 ASIC。这款定制芯片旨在为 OpenAI 的推理工作负载提供最佳计算平台,专注于每瓦性能和低延迟。Jalapeño ASIC 旨在超越当前行业领导者如 NVIDIA 的 GB200 和 GB300,尤其是在多芯片操作的能效和降低延迟方面。

  3. SIGNIFICANT · CL_195287 ·

    LTX-2.5 开放世界模型支持在 NVIDIA GPU 上进行本地 AI 视频制作

    一款新的开放权重世界模型 LTX-2.5 已发布,它使创作者能够在本地 NVIDIA RTX GPU 上执行视频生成和其他 AI 任务。该模型显著降低了 VRAM 要求,使得先进的视频制作在桌面硬件上即可实现。与现有的闭源替代品相比,LTX-2.5 提供了更高的稳定性和速度,能够快速迭代和批量生成内容,无需支付云服务费用。

  4. TOOL · CL_194272 ·

    MiniMax H3 模型通过 Sol Engine 实现重大速度提升

    MiniMax AI 宣布使用 Sol Engine 显著提高了其 MiniMax H3 模型的速度。这款原生于代理的 Sol Video Inference Engine 比 Diffusers 快 3.95 倍,比 SGLang 快 2.80 倍。该引擎通过处理 8 个 Nvidia GB200 单元,在 1344x768 分辨率和 24 FPS 下处理 124 帧,展示了其能力。

  5. RESEARCH · CL_98274 ·

    法国借助英伟达加速人工智能基础设施建设,Mistral AI 建立数据中心 · 跟踪 1 个来源

    法国正在显著推进其人工智能基础设施和生态系统,大量投资和新设施正在投入使用。Mistral AI 正在法国建立一个大型数据中心,利用英伟达的 GB200 系统并计划建设广泛的欧洲计算能力。其他举措包括 Scaleway 提供英伟达 Blackwell 实例,以及 Bull/Foxconn 在欧洲生产英伟达 Vera Rubin NVL72 系统。该国还通过针对欧洲语言和监管需求的开放模型,在公司如 Pleias 和英伟达 Nemotr…

  6. SIGNIFICANT · CL_63613 ·

    美国关闭中国企业在海外购买先进AI芯片的漏洞

    美国商务部工业与安全局(BIS)已关闭了一个允许中国在华外子公司获取先进AI芯片的漏洞。此前,马来西亚等国的公司可以合法购买这些芯片,导致数十万枚先进AI芯片可能被转移。此举旨在加强出口管制,防止中国通过间接渠道获取尖端AI硬件。