Nvidia 发布了 GLM-5.3,这是一款采用混合专家(MoE)架构的新模型,拥有 7530 亿总参数和 400 亿活跃参数。该模型采用稀疏 Attention 机制,支持 100 万个 token 的上下文窗口。通过 Model Optimizer 进行量化,将内存需求降低了 1.66 倍,允许在 Blackwell B300 平台上使用 SGLang 进行推理。 AI
影响 此次发布展示了模型架构和上下文窗口大小方面的进步,可能影响未来大型语言模型的发展。
排序理由 Nvidia 发布前沿模型及系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
- attention
- Blackwell B300
- GLM 5.3
- Model optimization of cadmium and accumulation in switchgrass (Panicum virgatum L.): potential use for ecological phytoremediation in Cd-contaminated soils
- NVFP4
- Nvidia
- SGLang
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →