NVIDIA Nemotron
PulseAugur coverage of NVIDIA Nemotron — every cluster mentioning NVIDIA Nemotron across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
IBM发布其AI开发代理Bob的自托管版本
IBM已发布其agentic软件开发平台Bob,支持自托管和隔离式企业环境。这使得公司可以在本地或私有云中运行该代理,而无需传输其代码。Bob支持使用NVIDIA Nemotron和Poolside Laguna等专有模型。
-
Salesforce 推出 AIforce,与 NVIDIA 合作开发开源 AI
Salesforce 揭晓了 AIforce,这是一个新的界面层,将现有产品与 AI 功能集成,由 Anthropic 的 Claude Cowork 和 Slack 提供支持。该公司还推出了 Koa,这是其首个 CRM 推理模型,并宣布与 NVIDIA 达成重要合作伙伴关系。此次合作标志着 Salesforce 战略性地转向利用开源 AI 模型,特别是 NVIDIA 的 Nemotron 系列,来驱动其推理引擎,旨在控制成本并提供无…
-
Mamba 架构挑战大型语言模型中的注意力机制
Mamba 架构正成为大型语言模型中占主导地位的基于注意力的机制的一个重要替代方案。这种源于 20 世纪 60 年代控制论的新方法,相比于注意力的二次方复杂度,提供了更高效的 O(n) 复杂度。Mamba 的实际应用正在推动大型语言模型的进步,并可能对 IBM Granite 4.0 和 NVIDIA Nemotron 等模型产生影响。
-
英伟达与CrowdStrike推出代理式AI用于网络安全防御
英伟达与CrowdStrike已合作推出SafeMind,这是一个代理式网络安全系统,旨在对抗日益自动化的网络攻击。该系统整合了CrowdStrike的网络安全专业知识和数据以及英伟达的Nemotron模型,创造了一个持续的协同进化循环,其中进攻性和防御性AI模型相互挑战和改进。目标是为防御者提供先进的AI能力,使其能够匹敌甚至超越对手使用的能力,从而确保更快、更有效的威胁响应。
-
亚马逊将英伟达GPU订单增至三倍,为满足AI需求增购200万颗芯片 · 追踪4个来源
亚马逊已显著扩大与英伟达的合作关系,同意为其AWS数据中心额外采购200万颗英伟达GPU芯片。这些芯片,包括Blackwell Ultra、Rubin和Rubin Ultra型号,计划于2027年和2028年交付。此交易使亚马逊的先前订单增至三倍,并反映了各行业对AI计算能力日益增长的需求。此次扩大的合作还涉及将英伟达的网络硬件、软件和机器人平台集成到AWS中,尽管亚马逊仍在继续开发自己的竞争性AI芯片。
-
印尼与 NVIDIA 和 Indosat 合作启动首个大学人工智能中心
Universitas Gadjah Mada (UGM)、Indosat Ooredoo Hutchison (Indosat) 和 NVIDIA 在日惹启动了印尼首个基于大学的人工智能技术中心。该倡议旨在培养本土人工智能人才,并为医疗保健、农业和灾害响应等国家优先事项创建人工智能解决方案。该中心将为研究人员和学生提供 NVIDIA 的人工智能平台(包括 GPU 和软件)的访问权限,以促进创新并应对该国的大规模挑战。
-
AI 领导者提议 SAFE 指南以提高网络安全透明度 · 已追踪 2 个来源
开放安全 AI 联盟(Open Secure AI Alliance)目前已包含 120 多个组织,正在制定名为“共享 AI 发现交流”(Shared AI Findings Exchange, SAFE)的新指南,以增强代理式 AI 的网络安全。该联盟由 NVIDIA、Cisco、CrowdStrike、Hugging Face 和 Red Hat 等成员牵头,并由 Linux Foundation 促进,旨在将 AI 网络安全事件…
-
Sakana AI 编排 Nvidia Nemotron 模型以媲美前沿 AI
Sakana AI 将 Nvidia 的 Nemotron 模型集成到其 Fugu 编排器中,该系统旨在为特定任务动态组合多个语言模型。该公司认为,这种被称为“集体智能”的方法可以实现与更大、单一前沿模型相当的性能。该策略旨在证明,协同工作的专用代理可以匹配或超越单体系统的能力,同时可能降低计算成本。
-
Thinking Machines Lab 发布 Inkling,一款开放权重的多模态模型
Thinking Machines Lab 发布了 Inkling,这是一款开放权重的多模态模型,拥有 9750 亿总参数和 410 亿活跃参数。该模型在 45 万亿个文本、图像、音频和视频 token 上进行了训练,并根据 Apache-2.0 许可提供。Inkling 虽然不被定位为前沿模型,但被设计为在其 Tinker 平台上进行微调的强大基础,提供多模态能力和高效推理。一个拥有 120 亿活跃参数的较小版本 Inkling-S…
-
AWS GovCloud 新增 NVIDIA Nemotron 和 OpenAI GPT OSS 模型
AWS 已将其 Amazon Bedrock 服务扩展到 AWS GovCloud (US) 区域,纳入了来自 NVIDIA 和 OpenAI 的开放权重模型。此次集成使美国政府机构及其承包商能够在安全合规的环境中利用先进的 AI 能力,例如情报分析和合规自动化。可用的模型包括 OpenAI 的 GPT OSS(120B 和 20B)以及 NVIDIA 的 Nemotron 系列(包括 Super 120B 和 Nano 变体),所有…
-
Ascoe Partners 开发使用 NVIDIA Nemotron 的市政AI系统“Navitron”
Ascoe Partners 开发了一个名为“Navitron”的本地部署AI系统,旨在指导市民完成市政流程。该系统利用NVIDIA的Nemotron开源模型,使其能够在地方政府基础设施内运行。此举旨在简化行政流程并改善公众获取信息的途径。
-
NVIDIA Boosts US AI Manufacturing with $500B Investment and Partner Network
NVIDIA 正在大力投资美国制造业和供应链,以支持对人工智能基础设施日益增长的需求。该公司及其合作伙伴正在美国 43 个州建立半导体、系统及相关组件的国内生产。该计划预计将为美国 GDP 做出重大贡献并创造大量就业机会,同时还注重负责任和可持续的制造实践。
-
Palantir部署NVIDIA Nemotron模型以保障美国机构AI安全
Palantir推出了一个新的AI引擎,利用NVIDIA的Nemotron开放模型为美国政府机构提供安全AI能力。该引擎允许机构在自己的基础设施上运行定制模型,用敏感数据进行训练,并完全拥有由此产生的模型。此次合作强调了开源AI的优势,包括透明度、定制化和控制力,这对于国家安全和复杂的政府运作至关重要。
-
法国借助英伟达加速人工智能基础设施建设,Mistral AI 建立数据中心 · 跟踪 1 个来源
法国正在显著推进其人工智能基础设施和生态系统,大量投资和新设施正在投入使用。Mistral AI 正在法国建立一个大型数据中心,利用英伟达的 GB200 系统并计划建设广泛的欧洲计算能力。其他举措包括 Scaleway 提供英伟达 Blackwell 实例,以及 Bull/Foxconn 在欧洲生产英伟达 Vera Rubin NVL72 系统。该国还通过针对欧洲语言和监管需求的开放模型,在公司如 Pleias 和英伟达 Nemotr…
-
NVIDIA推出XR AI,用于现实世界应用中的AR智能体
NVIDIA发布了NVIDIA XR AI,这是一个旨在构建智能体应用的开发者库,可将AI与增强现实和虚拟现实设备集成。该平台将XR硬件的现实世界信号与AI模型、企业数据和专用工具连接起来,从而实现能够在工作流程中感知、推理和行动的AI智能体。关键组件包括多模态感知、通过NVIDIA NeMo Retriever进行企业知识检索、对NVIDIA Nemotron等各种AI模型的支持以及智能体编排,所有这些都由NVIDIA的加速计算基础…
-
NVIDIA与HPE扩展AI Factory以迎接Agentic AI时代
NVIDIA与Hewlett Packard Enterprise (HPE)正在扩展其HPE AI Factory with NVIDIA,以支持企业环境中日益增长的Agentic AI需求。此次合作推出了专为AI Agent需求设计的NVIDIA Vera CPU,以及提供管理和保护自主AI工作流操作系统的NVIDIA Agent Toolkit。升级后的AI Factory还将在其解决方案中引入NVIDIA Confidenti…
-
新APEX框架增强AI代理的自我改进能力
研究人员推出了一种新颖的三层框架APEX,旨在增强AI代理的自我改进能力。与以往只关注提示词优化的方法不同,APEX同时演进代理的工具集、行为原则和工作流拓扑。这种多维协同进化方法在基于NVIDIA Nemotron构建的生产级AI代理Joe上得到了验证,显著提高了其健康得分并提炼出新的可复用原则。
-
NVIDIA发布用于代理和ASR的开源550B Nemotron 3模型
NVIDIA发布了其开源模型Nemotron 3系列,包括Nemotron 3 Ultra和Nemotron 3.5 ASR。Nemotron 3 Ultra是一个拥有5500亿参数的模型,专为长期AI代理设计,采用混合Mamba-Transformer架构和100万token的上下文窗口。Nemotron 3.5 ASR则针对流式语音识别和语音代理进行了优化。这些模型可在Together AI上获取,为各种AI应用提供高推理吞吐量和准确性。
-
金融公司采用交易基础模型构建统一的AI智能
金融机构正越来越多地采用交易基础模型,这是一种基于数十亿金融事件训练的大规模AI,以克服碎片化、任务特定AI系统的局限性。这些基于Transformer的模型利用专有数据,能够学习统一的消费者行为表征,并比传统算法从表格数据中提取更深入的见解。Revolut和Mastercard等公司正与NVIDIA合作开发和部署这些模型,在欺诈检测和信用评分等领域展示出显著的性能提升,同时减少了对广泛特征工程的需求。
-
Nvidia Nemotron 模型通过 OpenRouter 集成到 LangChain 中
本指南演示了如何使用 OpenRouter 的免费 API 将 Nvidia 的 Nemotron 模型集成到 LangChain 代理中。它提供了设置 Python 环境、获取 OpenRouter API 密钥以及配置代理以使用特定 Nemotron 模型的分步说明。该教程还展示了如何为代理配备自定义工具,例如天气函数,使其能够自动调用这些工具来回答用户查询。