阿里巴巴的 Qwen 团队预览了其 Qwen4 架构,并发布了 Qwen3.8-Flash-Next。这款新的混合专家模型每个 token 只使用其参数的一小部分,从而显著降低了训练成本。尽管效率很高,Qwen3.8-Flash-Next 仍表现出具有竞争力的性能,在编码和办公相关基准测试中优于 DeepSeek-V4-Flash 和 Claude Opus 4.6 等更大模型。 AI
影响 这款高效模型的发布给 OpenAI 和 Anthropic 等主要 AI 实验室带来了定价压力。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →