PulseAugur
中
实时 20:56:02
实体 Nemotron

Nemotron

PulseAugur coverage of Nemotron — every cluster mentioning Nemotron across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
70
90 天内 70
发布 · 30天
0
90 天内 0
论文 · 30天
11
90 天内 11
层级分布 · 90 天
主题
关系
时间线
  1. 2026-09-14 research_milestone Nvidia released the training methodology for its Nemotron model, which achieved a gold medal score on the International Mathematical Olympiad. 来源
  2. 2026-08-18 product_launch NVIDIA released the open Nemotron family of models to enable custom AI development. 来源
  3. 2026-06-18 product_launch NVIDIA released the Nemotron model for local execution. 来源
情绪 · 30 天

8 天有情绪数据

最近 · 第 1/4 页 · 共 76 条
  1. RESEARCH · CL_285527 ·

    英伟达 Nemotron 3 经过微调,达到奥林匹克级别 AI 性能

    英伟达的 Nemotron 3 基础模型已成功微调,在国际信息学奥林匹克竞赛 (IOI) 和国际数学奥林匹克竞赛 (IMO) 中均取得了金牌级性能。该过程涉及在特定领域数据上进行监督微调 (SFT) 和强化学习 (RL),以及迭代的生成-评估-精炼推理循环。对不同模型大小,如 Nemotron-3-Nano-CC 和 Nemotron-3-Ultra-CC 进行了调整,证明了专业化可以在无需全新基础模型的情况下实现高性能。

  2. COMMENTARY · CL_275876 ·

    寻找编程和长上下文问答的 LLM 替代模型

    一位 Reddit r/LocalLLaMA 社区用户正在寻找参数量低于 400 亿的大型语言模型推荐,作为 Qwen 和 DeepSeek 的替代品。用户特别需要擅长编程任务和长文档问答的模型,尤其是在处理长达 120,000 个 token 的上下文时。他们正在询问 Gemma 31B、Muse Glimmer 30B 和 Nemotron 等模型,以及这些替代模型的任何微调版本是否能在编程能力上超越 Qwen 3.8 27B。

  3. TOOL · CL_275158 ·

    新的SURGE技术无需额外训练即可增强RL模型

    研究人员开发了一种名为SURGE(Scaling Up RL Gradient-free via Eigenspace fusion)的新技术,可以在不增加额外训练时间或推理计算的情况下,提高现有强化学习(RL)模型的性能。SURGE结合了同一RL训练历史中的两个检查点,生成了一个优于两个原始检查点的新策略。该方法在数学推理和编码基准测试中均显示出改进,证明了存储的RL历史是扩展模型能力的宝贵资源。

  4. TOOL · CL_275147 ·

    新研究探讨了扩散 LMM 中的“两个时钟”:答案稳定与推理展开

    一篇新研究论文提出了扩散大型多模态模型(LMM)中“两个时钟”的概念,区分了答案何时稳定以及其推理何时完全生成。该研究分析了在三个视觉问答基准上的这种现象,发现相当一部分推理在答案稳定时仍未写出。对不同块长度和提示策略(包括直接指令)的实验显示了对准确性和覆盖率的影响,表明覆盖率是提示差异的更大组成部分,而非条件准确性。

  5. COMMENTARY · CL_274396 ·

    AI开发者提倡多模型验证以确保答案准确性

    一位AI开发者认为,当前的AI应用更像是“意见分发器”而非“答案引擎”,因为它们依赖单一模型的输出且未经验证。提出的解决方案是使用多个AI模型交叉核对答案,这种方法已在AI STEM解算器Forge中得到演示。该方法包括一个带有裁判模型的“辩论模式”,旨在识别错误并为用户提供“分歧图”,以突出显示差异,即使在使用更大、更强大的模型时也是如此。

  6. RESEARCH · CL_268732 ·

    新方法提升大语言模型推理效率与准确性 · 跟踪4个来源

    研究人员正在开发新方法来提高大语言模型的效率和推理能力。一种名为ReHoPER的方法会在提供最终答案之前,沿着多条路径生成并回答中间问题,在组合推理任务上显示出优势。另一种名为Settle的方法,训练模型判断其推理何时稳定,在MATH-500数据集上将token数量减少了40%,准确率损失极小。第三种技术使用自监督置信度训练,鼓励模型预测其对答案的置信度,在不明确优化缩短推理的情况下,在各种模型和基准测试中实现了高达25%的效率提升。

  7. COMMENTARY · CL_257840 ·

    英伟达因数据保留限制Claude使用,转而采用自家AI

    作为主要的AI硬件提供商和Anthropic的投资者,英伟达已限制其员工在敏感的内部项目中使用Anthropic的Claude模型。此举源于Anthropic在6月份的政策变更,取消了“零数据保留”选项,并开始保留客户日志长达两年。英伟达以及Palantir和Booz Allen Hamilton等其他公司,现在正选择使用自家AI解决方案,如Nvidia的Nemotron,来处理专有信息,这凸显了硬件提供商对流向模型供应商的数据日益增长的担忧。

  8. TOOL · CL_256150 ·

    Salesforce 推出基于 Nvidia 开放权重的专有 Koa 模型

    Salesforce 推出了 Koa,一个专有的推理模型,构建在 Nvidia 的开放权重 Nemotron 模型之上,专为企业销售和客户支持任务设计。尽管使用了开放权重的基座,Koa 的权重是闭源的,并且它只能在 Salesforce 的基础设施内运行,将其定位为一项托管服务,而不是一个可下载的模型。该公司还宣布与 Anthropic 合作,将 Claude 集成到 Salesforce 中,这表明该公司在开发内部能力和利用第三方模…

  9. TOOL · CL_255908 ·

    Salesforce 和 Nvidia 在 Nemotron 上推出 Koa CRM AI 模型 · 跟踪 4 个来源

    Salesforce 和 Nvidia 已联合发布 Koa,这是一款专为客户关系管理 (CRM) 任务设计的 AI 推理模型。Koa 基于 Nvidia 的开源 Nemotron 模型构建,旨在通过利用专门的代理基础设施和本地推理堆栈来减少对通用前沿 AI API 的依赖。Salesforce 强调,其丰富的 CRM 专业知识为 Koa 提供了比更广泛的 AI 模型更具竞争力的优势。

  10. SIGNIFICANT · CL_255440 ·

    Salesforce 和 Nvidia 发布 Koa,一款面向企业的推理 AI 模型

    Salesforce 和 Nvidia 合作开发了 Koa,这是一款专为销售、营销和客户支持等企业任务设计的新型推理 AI 模型。Koa 基于 Nvidia 的开源 Nemotron 模型构建,旨在为 Claude 和 ChatGPT 等专有前沿模型提供更具成本效益和安全性的替代方案。通过使用合成数据进行训练,Koa 确保了 Salesforce 生态系统内客户数据的隐私和数据安全要求合规性。这一举措代表了企业寻求量身定制的专业 AI…

  11. RESEARCH · CL_254818 ·

    新研究探讨合成数据生成框架与公平性

    两篇新研究论文探讨了用于AI模型的合成数据生成(SDG)的细微差别。第一篇论文介绍了NeMo Data Designer(NDD),一个用于创建多模态合成数据的开源框架,强调其可扩展性和用于可复现性的迭代设计。第二篇论文深入探讨了SDG中“不同影响”的概念,质疑合成数据生成方法是否会无意中为不同群体制造或加剧偏见,并提出分组建模作为一种潜在的缓解策略。

  12. TOOL · CL_254032 ·

    英伟达、Palantir 限制员工使用 Anthropic 的 Claude AI

    由于担心敏感内部数据被用于训练,英伟达(Nvidia)、Palantir 和 Booz Allen Hamilton 正在限制其员工使用 Anthropic 的 Claude AI 模型。英伟达(Nvidia)特别在其自有 Nemotron 模型上处理敏感项目,同时将 Claude 限制在较低敏感度的任务上。此举凸显了随着人工智能工具日益融入企业运营,企业对数据隐私和知识产权保护日益增长的担忧。

  13. RESEARCH · CL_251843 ·

    Nvidia公布IMO金牌AI方法,此前数学家表达担忧 · 追踪2个来源

    Nvidia公布了其Nemotron模型的训练方法,该模型在2026年国际数学奥林匹克竞赛(IMO)中取得了金牌分数。该模型名为Nemotron 3 Ultra 550B-A55B,以自然语言生成证明,这与传统的形式证明系统不同。此前,菲尔兹奖得主曾发表声明,警告在数学基准测试中快速使用AI,并对AI生成解决方案的完整性和彻底性表示担忧。

  14. TOOL · CL_251015 ·

    Nvidia与Palantir合作,通过集成AI优化芯片生产

    Nvidia与Palantir已建立合作伙伴关系,以简化芯片生产物流。他们集成的系统将Nvidia的Nemotron模型与Palantir的Foundry平台相结合,旨在为公司提供增强的数据控制,而无需依赖公共云基础设施。

  15. FRONTIER RELEASE · CL_247570 ·

    Sakana AI 发布 Fugu Max 和 Ultra v2,用于经济高效且高能力的多智能体任务 · 跟踪 4 个来源

    Sakana AI 推出了 Fugu Max 和 Fugu Ultra v2,这是其 Sakana Fugu 系列中用于多智能体编排的两个新模型。Fugu Max 针对成本效益进行了优化,其定价低于 Sonnet 5 和 GPT 5.6 Terra 等竞争对手,同时实现了强大的基准性能。另一方面,Fugu Ultra v2 专注于复杂、多步骤任务的高能力,据报道,在特定编码基准测试中,它在不依赖 OpenAI 的 GPT-6 Astr…

  16. COMMENTARY · CL_244516 ·

    Nemotron 对比 Claude Opus:供应链 AI 生产环境 A/B 测试

    进行了一项比较分析,以评估 Nemotron 和 Claude Opus 模型在供应链 AI 生产环境中的性能。该研究旨在确定特定用例的最佳模型,指导关于部署哪个 AI 以实现最高效率的决策。研究结果为在供应链管理中的实际应用中选择合适的大型语言模型提供了见解。

  17. TOOL · CL_242758 ·

    Nemotron 架构解决了 Transformer 与状态空间模型效率的权衡问题

    Nemotron 是一种新颖的架构,它解决了 Transformer 模型与状态空间模型之间固有的权衡问题。它旨在实现状态空间模型的效率,同时保留 Transformer 的性能能力。这种方法试图通过在计算成本和模型有效性之间找到折衷点来优化大型语言模型的发展。

  18. RESEARCH · CL_247298 ·

    Nemotron 3 Ultra 在数学奥林匹克竞赛中取得金牌级表现

    研究人员开发了一种新颖的方法来生成复杂的奥数竞赛问题的自然语言证明,并在2026年IMO竞赛中取得了金牌级表现。该系统基于经过后训练的Nemotron 3 Ultra检查点构建,无需依赖外部工具或形式化证明器即可迭代地改进候选证明。这个开放模型管道包括专门的检查点、训练数据和一个新的基准,展示了大型语言模型在高级数学推理方面的潜力。

  19. COMMENTARY · CL_232695 ·

    用户探索大语言模型用于代码逆向工程,并取得初步成效

    Mastodon 上的用户正在讨论他们用于代码逆向工程任务的首选大语言模型(LLM)。包括 Qwen、DeepSeek、Nemotron 和 Minimax 在内的多个模型正在被探索,并取得了初步成效,这凸显了该领域令人着迷的研究潜力。

  20. TOOL · CL_222176 ·

    AWS、NVIDIA 和 Heidi Health 将 ASR 推理成本降低 75%

    AWS、NVIDIA 和 Heidi Health 合作,在 Amazon EC2 实例上将自动语音识别 (ASR) 推理成本降低了 75%。通过实施 NVIDIA MPS 和 NVIDIA Triton 推理服务器,他们实现了所需 GPU 实例数量的 75% 的降低,从 16 个减少到 4 个,同时保持了亚秒级延迟。这种优化解决了 ASR 中每个请求的 GPU 利用率低的问题,而传统的 CUDA 时间切片会导致大量硬件容量闲置。