阿里巴巴的 Qwen 团队发布了 Qwen3.8-2.4T-A95B,这是他们 Qwen-Max 系列中的首个开放权重模型。这个拥有 2.4 万亿参数、每个 token 激活 950 亿参数的混合注意力架构的大模型,专为要求严苛的智能体和推理任务而设计。发布内容详细介绍了如何使用 vLLM 在 Amazon SageMaker HyperPod 上部署该模型,通过工具调用和推测解码等功能实现高效推理。 AI
影响 为开放权重模型树立了新的标杆,有望加速企业在复杂智能体工作负载方面的应用。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
- Alibaba Group
- Amazon SageMaker HyperPod
- Kimi k3
- NVIDIA B300 Blackwell Ultra GPUs
- OpenAI
- Qwen
- Qwen3.8-2.4T-A95B
- vLLM
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →