根据最近的一项比较,Qwen3.8-Max-0902 模型在编码任务上表现出优于 Anthropic 的 Claude Opus 5。这一进展凸显了大型语言模型能力的快速进步,尤其是在软件开发等专业领域。结果表明,竞争格局日益激烈,模型在特定领域的熟练程度正受到越来越严格的评估。 AI
影响 这一基准测试结果表明,Qwen 模型在专业编码任务中的竞争力日益增强,可能影响软件工程领域的未来发展和应用。
排序理由 该集群报告了两个 AI 模型之间的基准测试比较,表明了一个研究里程碑。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →