Cursor Research 已开源 Mixture-of-Kittens (MoK),这是一个专为 Mixture-of-Experts (MoE) 模型设计的专用训练内核。该超级内核将 MoE 通信和计算融合为单一的确定性过程,据称与现有基线相比,吞吐量提高了 2.37 倍。MoK 针对 NVIDIA GB200 NVL72 机架等高端硬件进行了优化,适用于大规模 AI 模型开发和训练。 AI
影响 加速高端硬件上大型 MoE 模型的训练,可能缩短先进 AI 的开发周期。
排序理由 Cursor Research 开源了一个专用的 MoE 模型训练内核(Mixture-of-Kittens),这是一个软件工具,而不是新的前沿模型发布。
- Cursor
- Mixture-of-Kittens
- Composer
- CUDA
- Cursor Research
- DeepSeek-V3
- GB300 NVL72
- Kimi 2.5
- NVIDIA Blackwell
- PyTorch
- Apache-2.0
- Composer 2.5
- Composer models
- CUDA toolkit 13.0+
- DeepSeek-V4-Pro
- GLM-5.2
- Mixture-of-Experts (MoE)
- Mixture-of-Kittens (MoK)
- NVIDIA Blackwell SM100
- NVIDIA Blackwell SM103
- NVIDIA GB200 NVL72
- NVL72
- Python 3.12+
- PyTorch 2.10+
- Qwen3.5-397B-A17B
AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →