PulseAugur
实时 12:56:05

NVIDIA 发布 Nemotron-3 Ultra 550B LLM 以实现高级推理

NVIDIA 发布了其 Nemotron-3 Ultra 550B 模型,这是一个专为高级推理和代理工作流设计的大型语言模型。该模型采用混合 LatentMoE 架构,结合了 Mamba-2 和注意力层,支持高达 100 万个 token 的上下文长度。它针对多步代理、长上下文分析和多语言推理等复杂任务进行了优化,其推理能力可通过聊天模板进行配置。 AI

影响 为代理推理和长上下文处理设定了新的基准,有可能加速复杂的 AI 工作流。

排序理由 来自前沿实验室 (NVIDIA) 的模型发布,包含系统卡详情。

在 Hugging Face Trending Models 阅读 →

AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →

NVIDIA 发布 Nemotron-3 Ultra 550B LLM 以实现高级推理

报道来源 [5]

  1. Hugging Face Trending Models TIER_1 Italiano(IT) · nvidia ·

    nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4

    text-generation · 196 downloads · 59 likes

  2. Hugging Face Trending Models TIER_1 Italiano(IT) · nvidia ·

    nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

    text-generation · 384 downloads · 53 likes

  3. Hugging Face Trending Models TIER_1 English(EN) · nvidia ·

    nvidia/nemotron-3.5-asr-streaming-0.6b

    automatic-speech-recognition · 225 downloads · 97 likes

  4. r/LocalLLaMA TIER_1 English(EN) · /u/justdoitanddont ·

    NVIDIA Nemotron 3 Ultra 发布。

    <!-- SC_OFF --><div class="md"><p>Not sure how much this is in the &quot;local&quot; world but interesting what they are putting out. </p> <p><a href="https://developer.nvidia.com/blog/nvidia-nemotron-3-ultra-powers-faster-more-efficient-reasoning-for-long-running-agents/">https:…

  5. r/LocalLLaMA TIER_1 English(EN) · /u/jacek2023 ·

    nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 · Hugging Face

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1twla1k/nvidianvidianemotron3ultra550ba55bbf16_hugging/"> <img alt="nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 · Hugging Face" src="https://external-preview.redd.it/SYWPdNi10HCp2771NvLU21deO0yBffz9XcMeE5wwU…