Together AI 已宣布 NVIDIA 的 Nemotron 3.5 Lightning 模型现已可用。该开放模型专为大批量、专业化的代理工作负载而设计,可提供高达 4 倍的吞吐量和 30% 的任务完成速度。它采用 30B 混合 MoE 架构,拥有 3B 活跃参数、1M 上下文窗口和 DFlash 推理解码,使其成为开发人员快速且可定制的选择。 AI
影响 为大批量代理任务提供了一个快速、开源的模型,有可能加速专业化人工智能应用的开发。
排序理由 前沿实验室模型发布,附带系统卡。
在 X — Together (inference / OSS) 阅读 →
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →