Fireworks AI 现已在其推理平台上提供 NVIDIA 的 Nemotron 3 Ultra 模型,为该新模型提供首日支持。Nemotron 3 Ultra 专为复杂的、长时间运行的任务而设计,例如编码代理和深度研究,采用混合 Transformer-Mamba 架构,上下文长度高达 100 万 token。NVIDIA 声称,与类似的开源模型相比,该模型在代理任务上的推理速度提高了五倍,成本降低了高达 30%。 AI
影响 加速复杂、长时间运行任务的先进代理 AI 的部署。
排序理由 这是推理平台的产品发布,提供特定模型,而非前沿实验室的核心模型发布。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →