阿里巴巴的 Qwen3.8-Max-0902 模型在 Code Arena: WebDev 竞赛中以 1691 分的成绩获得第一名。该新模型超越了之前的基准,得分比 Claude Opus 5 高出 3 分,比 Kimi K3 高出 17 分,比其前身 Qwen3.8-Max 高出 22 分。该模型的定价为 $5/MToken。 AI
影响 在编码基准测试中树立了新标准,可能影响未来的模型开发和竞争。
排序理由 主要实验室模型的新基准测试结果。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →