PulseAugur
实时 11:00:05
English(EN) A 27B Local Model Just Topped the Leaderboard — Qwen3.8-27B Is Open Source

Qwen3.8-27B开源模型凭借先进的智能体能力登顶排行榜

阿里巴巴的Qwen团队已开源Qwen3.8-27B,这是一个拥有270亿参数的模型,在包括SWE Bench Pro和OSWorld在内的多个基准测试中取得了顶级排名。该模型在智能体能力方面展现出显著的进步,例如规划和多步任务完成,其表现优于更大的模型甚至云端旗舰模型。其架构融合了线性和全注意力层的创新组合,以高效处理长上下文,并为用户提供可控的“思考”模式。该模型的跨模态训练使其能够有效地在桌面、浏览器和移动设备等各种界面上运行。 AI

影响 在智能体基准测试中设定了新的SOTA(State-of-the-Art),展示了强大的本地模型能力,并推动了云模型性能。

排序理由 前沿实验室模型发布,附带系统卡和基准测试结果。[lever_c_从frontier_release降级:ic=2 ai=1.0]

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Qwen3.8-27B开源模型凭借先进的智能体能力登顶排行榜

报道来源 [2]

  1. dev.to — LLM tag TIER_1 English(EN) · PhoenixWang ·

    一个27B的本地模型刚刚登顶排行榜 — Qwen3.8-27B 已开源

    <p>On August 14, 2026, the Qwen team at Alibaba open-sourced Qwen3.8-27B: a 27B-parameter dense model, Apache-2.0 licensed.</p> <p>Then the benchmark table dropped. SWE-bench Pro: <strong>61.7 — first place</strong>.</p> <p>Look at who's in that table: Qwen3.6-27B, Qwen3.7-Plus, …

  2. r/LocalLLaMA TIER_1 English(EN) · /u/synth_mania ·

    Qwen3.8-27b 展现了我见过的本地模型中最高的“自主性”水平

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1vt78xd/qwen3827b_has_the_highest_level_of_agency_ive/"> <img alt="Qwen3.8-27b has the highest level of &quot;agency&quot; I've ever seen in a local model" src="https://preview.redd.it/gs573xy8yfkh1.jpeg?width…