NVIDIA 发布了 Qwen3.8-2.4T-A95B,这是一个混合专家(MoE)模型,拥有 2.4 万亿参数和 950 亿活跃参数。该模型采用 NVFP4 量化和 4 位精度,针对 GB200/B300 硬件上的 vLLM 和 SGLang 进行了优化。它支持 100 万个 token 的上下文长度。 AI
影响 此次发布提供了一个高效的 MoE 模型,具有大上下文窗口,有望提高复杂 AI 任务的性能并降低资源需求。
排序理由 来自主要 AI 实验室(NVIDIA)的模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →