NVIDIA 发布了其 Nemotron-3 Ultra 550B 模型,这是一个专为高级推理和代理工作流设计的大型语言模型。该模型采用混合 LatentMoE 架构,结合了 Mamba-2 和注意力层,支持高达 100 万个 token 的上下文长度。它针对多步代理、长上下文分析和多语言推理等复杂任务进行了优化,其推理能力可通过聊天模板进行配置。 AI
影响 为代理推理和长上下文处理设定了新的基准,有可能加速复杂的 AI 工作流。
排序理由 来自前沿实验室 (NVIDIA) 的模型发布,包含系统卡详情。
在 Hugging Face Trending Models 阅读 →
- Hugging Face
- LatentMoE
- Mamba-2
- Nemotron-3-Ultra-550B-A55B-BF16
- NVIDIA
- NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
- SGLang
- Transformers
- vLLM
AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →