杰富瑞分析师近期对八款主流AI智能体在真实办公场景下的任务表现进行了评估,阿里巴巴的Qwen Office位居榜首。该智能体在包括网页浏览和多模态内容生成在内的复杂任务中均展现出强大性能,所有测试维度得分均超过90分。报告指出,Qwen Office与其底层Qwen 3.8 Max模型协同工作,加上其工程机制(Harness),是其性能和成本效益优于Claude Cowork和Codex等竞争对手的关键。分析还强调了每任务成本以及工作流集成和生态系统协作等企业级功能在竞争激烈的AI智能体市场中的日益增长的重要性。 AI
影响 该基准测试表明,集成了模型性能和工程效率的AI智能体解决方案正成为企业市场的关键差异化因素。
排序理由 对多款AI智能体在真实任务中进行的基准评估,突出了特定产品的性能和成本优势。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →