NVIDIA Nemotron 3
PulseAugur coverage of NVIDIA Nemotron 3 — every cluster mentioning NVIDIA Nemotron 3 across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
NVIDIA发布SEA-LION-v4.8模型,支持东南亚语言
NVIDIA发布了一份技术报告,详细介绍了基于NVIDIA Nemotron 3架构构建的SEA-LION-v4.8系列模型。这些模型,包括30B-A3B和120B-A12B变体,已通过东南亚、推理、代码和多语言数据集进行了增强。SEA-LION模型在SEA-HELM基准测试中表现出显著的改进,尤其是在七种东南亚语言的指令遵循、自然语言推理和理解方面。
-
OpenRouter的免费AI模型以数据换取访问权限,隐私政策不明确
OpenRouter提供对各种AI模型的免费访问,但这需要以用户数据和不可预测的服务为代价。虽然该平台提供每日50次请求的免费额度,但通过一次性存入10美元可以增加到1000次,如果用户只使用免费模型,这笔存款不会被消耗。要使用这些免费模型,用户必须明确启用隐私设置,允许合作伙伴提供商在用户数据(包括提示和完成内容)上进行训练。然而,OpenRouter的文档并未明确说明其零数据保留政策是否适用于免费端点,用户讨论表明提示和输出可能会…
-
Amazon SageMaker 为 NVIDIA Nemotron 3 LLM 增加无服务器微调功能
Amazon SageMaker AI 现在为 NVIDIA 的 Nemotron 3 系列开放权重大型语言模型提供无服务器模型定制。此功能允许企业使用监督微调 (SFT) 和强化学习等技术微调 Nemotron 3 Nano 和 Nemotron 3 Super 等模型,而无需管理基础设施。Nemotron 3 架构结合了 Mamba-Transformer 专家混合层,可实现高效的序列处理和参数激活,从而以更低的计算成本实现高吞吐量和准确性。
-
Together AI 发布 NVIDIA 的多模态和 1M 上下文 Nemotron 3 模型
Together AI 已在其平台上发布了 NVIDIA 的 Nemotron 3 模型,包括多模态的 Nano Omni 和大上下文的 Super。Nemotron 3 Nano Omni 是一个 30B 参数模型,擅长同时处理视频、图像、音频和语言的推理,非常适合代理应用。Nemotron 3 Super 是一个 120B 参数模型,拥有 100 万个 token 的上下文窗口和多 token 预测,可高效处理复杂的推理和长上下文…