阿里巴巴集团已更新其旗舰大型语言模型Qwen3.8-Max,显著提升了其性能,尤其是在编码和专业办公任务方面。更新后的模型在前端编程的CodeArena基准测试中位居全球第一,得分1691,超越了Claude Opus5和Kimi K3等模型。Qwen3.8-Max拥有2.4万亿参数,并支持100万token的上下文窗口,使其能够胜任复杂的企业任务和研究。该模型现已通过Qwen AI平台的API提供服务,并已集成到Qwen Office、Qoder和Qwen APP中。 AI
影响 在前端编码基准测试中创下新的SOTA(State-of-the-Art),可能影响企业采用和竞争格局。
排序理由 Frontier-lab模型发布,附带系统卡和基准测试结果。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
- Alibaba Group
- Qwen3.8-Max
- APP
- Claude Opus5
- CodeArena: Inspecting and Improving Code Quality Metrics using Minecraft
- Kimi k3
- Qoder
- Qwen AI platform
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →