NVIDIA 发布了 Nemotron 3.5 Lightning,这是一个开放的 30B Mixture-of-Experts 模型,针对 AI 代理的执行层进行了优化。该模型仅有 3B 激活参数,专为工具调用、输出验证和代码格式化等高频操作任务而设计,为这些特定功能提供了比大型模型更低延迟和更低成本的替代方案。Nemotron 3.5 Lightning 可在 AIHubMix 平台上免费使用,支持高达 100 万个 token 的上下文窗口,并提供兼容 OpenAI 的 API 以便集成。 AI
影响 优化 AI 代理执行层,可能降低高频任务的成本和延迟。
排序理由 Frontier-lab 模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →