阿里巴巴已发布其 Qwen3.8-2.4T-A95B 模型的开放权重。该混合专家(MoE)模型拥有 2.4 万亿总参数,其中 950 亿为激活参数。它采用了混合注意力机制,专为长上下文、智能体(agentic)工作负载设计,并附带了 SageMaker HyperPod 和 vLLM 的配置指南。 AI
影响 此次发布提供了一个强大的、具有开放权重的 MoE 模型,有望加速智能体 AI 和长上下文应用领域的研究与开发。
排序理由 前沿实验室模型发布,开放权重。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →