Nvidia 发布了 GLM-5.3-Flash NVFP4 模型,这是 ZAI 的 GLM-5.3-Flash 的量化版本。这款多模态混合专家模型专为推理、编码和智能体任务设计,采用混合注意力架构,支持高达 100 万个 token 的上下文长度。该模型针对 NVIDIA 硬件进行了优化,提供更快的训练和推理速度,并兼容 vLLM 和 SGLang 等各种运行时引擎以及 NVIDIA Blackwell 微架构。 AI
影响 这款具有 1M 上下文窗口的多模态模型有望加速智能体系统和长上下文应用的开发。
排序理由 来自主要 AI 实验室 (Nvidia) 的模型发布,包含具体技术细节和多模态能力。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- Linux
- Model Optimizer
- Nemotron-Post-Training-Dataset-v2
- Nvidia
- NVIDIA Blackwell B200
- nvidia/GLM-5.3-Flash-NVFP4
- NVIDIA Model Optimizer
- SGLang
- vLLM
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →