PulseAugur
实时 09:29:52
English(EN) NVIDIA Releases Nemotron-Labs-TwoTower: an Open-Weight Diffusion Language Model Built on a Frozen Autoregressive Nemotron-3-Nano-30B-A3B Backbone

NVIDIA 发布 Nemotron-Labs-TwoTower 以实现更快的文本生成 · 跟踪 4 个来源

NVIDIA 推出了 Nemotron-Labs-TwoTower,这是一款开放权重的扩散语言模型,旨在提高文本生成吞吐量。该模型将扩散过程分为两个独立的组件:一个冻结的自回归上下文塔和一个训练好的去噪器塔。这种架构允许并行生成 token,实现了 2.42 倍的吞吐量提升,同时保留了传统自回归模型 98.7% 的质量。 AI

影响 这种新颖的双塔架构可能为高效的 LLM 推理设定新标准,有望加速实时 AI 应用。

排序理由 NVIDIA 发布了一款具有新颖架构的新型开放权重模型,以提高性能。

在 MarkTechPost 阅读 →

AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →

NVIDIA 发布 Nemotron-Labs-TwoTower 以实现更快的文本生成 · 跟踪 4 个来源

报道来源 [4]

  1. MarkTechPost TIER_1 English(EN) · Asif Razzaq ·

    NVIDIA 发布 Nemotron-Labs-TwoTower:基于冻结的自回归 Nemotron-3-Nano-30B-A3B 主干的开放权重扩散语言模型

    <p>NVIDIA has released Nemotron-Labs-TwoTower, a diffusion language model built on a pretrained autoregressive backbone. It ships as open weights under the NVIDIA Nemotron Open Model License. The release targets a throughput bottleneck in text generation. Autoregressive (AR) mode…

  2. Mastodon — fosstodon.org TIER_1 Deutsch(DE) · [email protected] ·

    RT @NVIDIAAI: 我们将一个30B模型分成两半,以并行而非顺序的方式处理token。推出Nemotron-Labs-TwoTower

    RT @NVIDIAAI: Wir haben ein 30B-Modell in zwei Hälften aufgeteilt, um Tokens parallel statt nacheinander zu verarbeiten. Wir stellen vor: Nemotron-Labs-TwoTower, ein Diffusions-Sprachmodell von NVIDIA Research, das auf Nemotron-3-Nano-30B-A3B basiert. So funktioniert es: Eine Häl…

  3. Mastodon — mastodon.social TIER_1 Deutsch(DE) · [email protected] ·

    RT @NVIDIAAI: 我们将一个300亿参数的模型一分为二,以并行而非顺序的方式生成token。推出 Nemotron-Labs-TwoTower:ei

    RT @NVIDIAAI: Wir haben ein 30B-Modell in zwei Hälften aufgeteilt, um Token parallel statt nacheinander zu schreiben. Wir stellen Nemotron-Labs-TwoTower vor: ein Diffusions-Sprachmodell von NVIDIA Research, das auf Nemotron-3-Nano-30B-A3B basiert. So funktioniert es: Eine Hälfte …

  4. Mastodon — mastodon.social TIER_1 English(EN) · [email protected] ·

    NVIDIA 发布了 TwoTower,一个基于冻结自回归骨干网的开源权重扩散语言模型。它保留了 98.7% 的基线质量,同时实现了

    NVIDIA has released TwoTower, an open-weight diffusion language model built on a frozen autoregressive backbone. It retains 98.7% of baseline quality while achieving 2.42x faster text generation. https://www. marktechpost.com/2026/07/01/nv idia-releases-nemotron-labs-twotower/ # …