NVIDIA B300
PulseAugur coverage of NVIDIA B300 — every cluster mentioning NVIDIA B300 across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
AMD MI355X GPU 为 Kimi K3 模型提供更优的每美元性能
来自 Wafer.ai 的一篇博文详细介绍了他们如何在 AMD 的 MI355X GPU 上运行 Kimi K3 模型,从而实现了更优的每美元性能。尽管 Kimi K3 拥有 2.8T 的巨大参数量,需要大量的 VRAM,但 MI355X 凭借其每个 GPU 288GB 的 VRAM,证明了其作为 NVIDIA B300 和 B200 GPU 的经济高效替代方案。虽然 NVIDIA 的硬件提供了更高的总吞吐量,但 MI355X 提供了…
-
Thinking Machines 发布 Inkling,一款高效的多模态 MoE 模型
Thinking Machines 发布了 Inkling,这是一款新的开源、多模态混合专家(MoE)模型,拥有 9750 亿总参数和 410 亿活跃参数。该模型支持 100 万 token 的上下文窗口,并具有可控思考能力,允许用户调整推理成本。Inkling 旨在通过为企业用例提供效率和灵活性来与 Anthropic 和 OpenAI 等成熟的参与者竞争。
-
TurboServe系统优化流式视频生成服务
研究人员开发了TurboServe,一个专门为流式视频生成设计的新型服务系统。该系统通过集成调度、自动扩缩容和迁移机制,解决了会话状态管理和动态资源分配等挑战。TurboServe旨在降低流式视频生成工作负载的延迟和运营成本,并在生产跟踪评估中显示出显著的改进。
-
Together AI 为推理增加了数千块 NVIDIA B200/B300 芯片
Together AI 已显著扩展其云计算资源,增加了数千块新芯片,包括 NVIDIA 的 B200 和 B300 加速器。此举旨在加强其专用模型推理服务,为人工智能模型的部署和运行提供增强的功能。