PulseAugur
实时 15:00:06
实体 Nemotron 3 Super 120B

Nemotron 3 Super 120B

PulseAugur coverage of Nemotron 3 Super 120B — every cluster mentioning Nemotron 3 Super 120B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 7 条
  1. RESEARCH · CL_252004 ·

    Salesforce发布企业级AI模型Koa;Bash在代理方面表现优于专用工具

    Salesforce开发了一个名为Koa的企业语言模型,该模型基于Nemotron-3-Super-120B并进行了强化学习增强。该模型专为代理工具使用而设计,特别是在客户关系管理领域,并在相关基准测试中表现优于其基础模型和专有基线。此外,一项比较企业代理工具接口的研究发现,单独使用Bash通常优于专用工具甚至程序化工具调用,尤其是在效率和成本方面,尽管程序化工具调用为特定的企业需求提供了安全的替代方案。

  2. TOOL · CL_232015 ·

    OpenRouter 比 NVIDIA 自家 API 更快地提供了 NVIDIA 的 Nemotron 3

    最近的一项基准测试显示,NVIDIA 开发的 Nemotron 3 Super 120B 模型,通过 OpenRouter 的免费套餐提供的速度比通过 NVIDIA 自家 API 提供的速度更快。测试表明,与 NVIDIA 的第一方终端相比,OpenRouter 在首次令牌响应速度和每秒令牌数方面表现更优。这表明,拥有可用容量的第三方提供商有时可以超越直接供应商的性能,尤其是在免费套餐上,并突显了 API 性能随时间的波动性。

  3. TOOL · CL_224949 ·

    审计发现 64 个 GGUF 量化模型标签错误,默默使用备用类型

    对 25 个仓库中的 443 个 GGUF 量化模型进行的审计发现,有 64 个文件与其声称的量化类型不匹配。这种差异发生是因为某些量化类型(如 k-quants 和 i-quants)要求张量维度能被 256 整除。当不满足此条件时,量化工具会默默地替换为另一种兼容的类型,这通常会导致每权重比特数 (bpw) 值高于文件名所示。在 Nemotron-3.5-Lightning 和 Qwen3.8-Flash-Next 等模型中观察到…

  4. RESEARCH · CL_141160 ·

    研究发现:大型语言模型会捏造沙特法律引文,但不会捏造GDPR · 跟踪2个来源

    一项新的基准研究揭示,大型语言模型(LLMs)在准确引用法律文件方面存在显著差异,尤其是在处理不同司法管辖区时。虽然Gemini 2.5 Flash、GPT-OSS-120B和Nemotron-3-Super-120B等模型在欧盟的《通用数据保护条例》(GDPR)方面表现良好,但它们经常捏造沙特《个人数据保护法》(PDPL)的引文。这种捏造无论查询语言(阿拉伯语或英语)如何都会发生,并且通常以高度自信的方式呈现,这凸显了在依赖LLMs…

  5. COMMENTARY · CL_97442 ·

    LLM社区呼吁紧急发布80-160B参数模型

    r/LocalLLaMA子版块的用户正在表达对80-1600亿参数范围内新的大型语言模型(LLM)的强烈需求。现有模型要么对于拥有高容量但速度较慢的统一内存系统(如Apple设备或AMD Ryzen AI 395)的用户来说太小,要么对于VRAM有限的用户来说太大。社区要求能够有效利用80-128GB RAM或64GB VRAM的系统运行的模型,因为现有选项要么过时,要么不适合他们的硬件配置。

  6. TOOL · CL_72287 ·

    爱沙尼亚基准测试:Claude Opus 4.7 最能抵御俄罗斯宣传

    爱沙尼亚语言研究所发布了一项名为“宣传抵抗”的新基准测试,以评估大型语言模型在抵御俄罗斯国家支持的虚假信息方面的能力。该基准测试涵盖了三种语言中的14种俄罗斯宣传叙事,模型回答了75个问题。Anthropic的Claude Opus 4.7表现最佳,得分接近满分,而NVIDIA的Nemotron 3 Super 120B和阿里巴巴的Qwen 3.6 Plus也表现出强大的抵抗力。

  7. COMMENTARY · CL_57194 ·

    西方开源模型在SOTA竞赛中落后于中国AI

    Reddit的r/LocalLLaMA板块的讨论表明,目前的开源模型SOTA(State-of-the-Art,技术最先进)之争在Google的Gemma 4 31B和Mistral AI的Nemotron 3 Super 120B之间。讨论中表达了对西方模型未能在此特定基准上领先的失望,并提到了Meta过去的贡献。对话还强调了中国AI模型正在形成的激烈竞争格局。