PulseAugur
实时 12:30:29
实体 B200s

B200s

PulseAugur coverage of B200s — every cluster mentioning B200s across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. SIGNIFICANT · CL_145120 ·

    Thinking Machines 在 Modal 上推出多模态 AI 模型 Inkling

    Thinking Machines 推出了 Inkling,这是一款能够处理文本、图像和音频以生成文本输出的新型多模态 AI 模型。该模型采用混合专家架构,拥有 9750 亿个总参数和 100 万个 token 的上下文窗口,旨在实现高效和快速。Inkling 现在可通过 Modal 的托管端点访问,提供基于 token 的定价和为代理工作负载优化的性能。

  2. RESEARCH · CL_108834 ·

    新的推测解码方法提高了 LLM 推理速度和安全性

    研究人员正在开发先进的推测解码技术,以加速大型语言模型推理。HyperDFlash 针对 DeepSeek-V4 的多超连接架构优化了解码,提高了草稿的准确性和速度。Dustin 通过识别关键标记并减少重新计算来专注于高效的长上下文生成。同时,TAIS 对推测解码的输出进行安全性不变性筛选,发现在温度为零时没有分歧。JetSpec 和 RLM-Cascade 通过结合草稿策略并在响应级别应用推测解码来实现高性价比的 API 服务,提供…

  3. COMMENTARY · CL_97764 ·

    AI GPU短缺受到质疑,发现存在显著的利用不足

    对 AI 工作负载中 GPU 利用率的最新分析表明,像 NVIDIA 的 H100s 和 Blackwell B200s 这样的高端 GPU 的感知短缺可能因利用不足而加剧。所讨论的 GPU 花费了大量时间处于空闲状态,等待数据,而不是主动处理。这一观察结果引发了对 AI 开发中 GPU 瓶颈的真实性质的质疑,暗示数据管道效率低下可能是重要的促成因素。

  4. TOOL · CL_97015 ·

    Together Compute 扩展 GPU 产品线,新增 H100、H200 和 B200

    Together 是一家推理和开源人工智能公司,已显著扩展其按需计算平台。该公司宣布在其基础设施中增加了大量的 H100、H200 以及更新的 B200 等高端 GPU。