OpenMDW-1.1
PulseAugur coverage of OpenMDW-1.1 — every cluster mentioning OpenMDW-1.1 across labs, papers, and developer communities, ranked by signal.
-
NVIDIA发布具有100万上下文的Nemotron-Labs-Teacher模型 · 跟踪4个来源
NVIDIA发布了一系列Nemotron-Labs-Teacher模型,每个模型拥有5500亿参数,但只有550亿参数被激活使用。这些模型采用了包含Mamba-2、MoE和多Token预测的LatentMoE架构,支持高达100万Token的上下文窗口。这些模型在OpenMDW-1.1许可下可用,并且需要大量的硬件支持,例如4块B200/GB200或8块H100 GPU才能运行。
-
英伟达的 NeMo Switchyard 将 AI 代理成本降低 74%,盖过了其新模型发布
英伟达发布了两项新技术:Nemotron 3.5 Lightning,一个开源权重语言模型;以及 NeMo Switchyard,一个用于 AI 代理的开源路由库。虽然 Nemotron 3.5 Lightning 是一个标准的 30B 参数模型,但 NeMo Switchyard 因其显著降低 AI 代理成本的潜力而备受关注。早期基准测试表明,NeMo Switchyard 可通过智能路由请求至更便宜的模型,将大部分调用避开昂贵的尖…
-
NVIDIA 发布 Alpamayo 2 Super 用于自动驾驶汽车,提供商业开放使用 · 追踪 4 个来源
NVIDIA 发布了 Alpamayo 2 Super,这是一款专为机器人出租车和自动驾驶汽车设计的新型开源模型。该模型基于 NVIDIA Cosmos 3 Super Reasoner 构建,并通过强化学习得到增强,旨在改进自动驾驶系统处理复杂、罕见场景的方式。Alpamayo 2 Super 可在宽松的商业许可下使用,允许开发人员为其生产用途进行改编和部署,并在 LingoQA 等基准测试中展现出领先性能,优于 Gemini 2.…
-
开源AI模型在Hugging Face上获得关注
一些开源AI模型在Hugging Face上正获得关注,其中MiniMaxAI/MiniMax-H3在图像-文本到视频功能方面下载量和点赞数领先。DeepSeek-V4-Flash-0731、DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF和baidu/Unlimited-OCR等模型在文本生成和图像到文本任务中的表现也备受瞩目。
-
Poolside 的 Laguna S 2.1 开源模型超越 DeepSeek-V4-Pro-Max
Poolside 发布了 Laguna S 2.1,这是一款拥有 1180 亿参数的专家混合(Mixture-of-Experts)模型,在 Terminal-Bench 2.1 基准测试中表现优于拥有 1.6 万亿参数的 DeepSeek-V4-Pro-Max。这款美国制造的开源模型拥有高达 100 万个 token 的上下文窗口,并具有独特的“思考”和“无思考”模式。该模型在不到九周的时间内开发和发布,采用 OpenMDW-1.1…
-
NVIDIA 发布 Nemotron-Labs-3-Puzzle-75B 以支持 Blackwell 硬件
NVIDIA 发布了其 Nemotron-Labs-3-Puzzle-75B 模型,该模型已针对 Blackwell 硬件上的服务进行了优化。该模型集成了 LatentMoE、Mamba-Interleaving 和 Multi-Token Prediction (MTP) 以提高吞吐量。它在 OpenMDW-1.1 许可下可用,允许商业使用。
-
NVIDIA 发布免费的 550B Nemotron 3 Ultra 模型,需要数据中心进行托管
NVIDIA 发布了 Nemotron 3 Ultra,这是一个拥有 5500 亿参数的开放权重模型,采用了混合 Mamba-Attention 设计和一百万个 token 的上下文窗口。该模型权重在 OpenMDW-1.1 许可下免费提供,但自行托管需要大量数据中心级别的硬件,例如多块 H100 或 H200 GPU。为了方便访问,NVIDIA 提供了一个兼容 OpenAI 协议的托管 API。