阿里巴巴的Qwen3.8-Max-0902模型在Code Arena的WebDev类别中取得了最高分1,691分,位居榜首。该模型在帕累托前沿也处于领先地位,以每百万token 5美元的极具竞争力的价格提供服务。这一表现使其超越了HY4 Preview等其他模型,并且显著低于Claude Opus的成本,从而使开发人员能够更轻松地获得先进的代理能力。 AI
影响 为AI编码助手设定了新的性能和成本基准,可能加速自主代理循环的采用。
排序理由 在公认的评估平台上取得模型基准成就。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →