阿里巴巴的 Qwen 团队发布了 Qwen3.8-2.4T-A95B,这是 Qwen-Max 级别模型的首次开放权重发布。该大型模型采用混合注意力架构,拥有 2.4 万亿参数,每个 token 激活 950 亿参数,专为要求严苛的智能体和推理任务而设计。此次发布包括开放权重,并展示了使用 vLLM 和 NVIDIA B300 Blackwell Ultra GPU 在 Amazon SageMaker HyperPod 上的部署,提供了一个与 OpenAI 兼容的端点。 AI
影响 为开放权重前沿模型树立了新的标杆,有望加速复杂智能体任务的自托管 AI 部署。
排序理由 阿里巴巴发布了带有开放权重和系统卡的 Frontier-lab 模型。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 AWS Machine Learning Blog 阅读 →
- Alibaba Group
- Amazon SageMaker HyperPod
- Kimi k3
- NVIDIA B300 Blackwell Ultra GPUs
- OpenAI
- Qwen
- Qwen3.8-2.4T-A95B
- vLLM
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →