Qwen3.8 Max
PulseAugur coverage of Qwen3.8 Max — every cluster mentioning Qwen3.8 Max across labs, papers, and developer communities, ranked by signal.
- 2026-09-07 product_launch Alibaba released the Qwen3.8 Max model, featuring a 1 million token context window and competitive pricing. 来源
- 2026-09-07 product_launch Alibaba's Qwen3.8 Max model was released with a 1 million token context window and competitive pricing. 来源
- 2026-08-19 research_milestone Qwen3.8 Max topped the Agentic Index, a benchmark for complex agentic scenarios. 来源
- 2026-08-08 product_launch Alibaba Group released the Qwen3.8 Max large language model with open weights, a 1 million token context window, and competitive pricing. 来源
- 2026-08-06 research_milestone Alibaba's Qwen3.8 Max achieved a score of 56 on the Artificial Analysis Intelligence Index. 来源
- 2026-08-06 research_milestone Alibaba's Qwen3.8 Max achieved a score of 56 on the Artificial Analysis Intelligence Index, matching Claude Opus 4.8. 来源
- 2026-08-03 product_launch Alibaba Group officially released the Qwen3.8 Max, a new open-weight large language model. 来源
4 天有情绪数据
Qwen3.8 Max cost-effectiveness is a key differentiator
Multiple clusters highlight Qwen3.8 Max's significantly lower cost compared to competitors like Claude Fable 5 (8x cheaper per 1M output tokens) and Kimi k3. This cost advantage, coupled with its strong performance, positions Qwen3.8 Max as a highly attractive option for developers prioritizing budget efficiency.
Qwen3.8 Max will be integrated into Alibaba Cloud services
Alibaba's release of the 2.4T parameter Qwen3.8 open-source model, based on Qwen3.8 Max, suggests a strategic push to leverage this technology. It is highly probable that Alibaba will integrate Qwen3.8 Max and its variants into their cloud offerings to attract AI development workloads and compete with other major cloud providers.
Qwen3.8 Max to release enterprise API within 60 days
Qwen3.8 Max has shown strong performance matching Claude Opus 4.8 and Claude Fable 5, while also leading in agent benchmarks. Given its open-source release and strong performance, Alibaba is likely to offer an enterprise-grade API to monetize these advancements and compete with existing cloud AI providers.
Qwen3.8 Max to release a more cost-effective variant within 30 days
Recent evidence highlights that while Qwen3.8 Max matches Claude Opus 4.8 in performance, Kimi k3 remains more cost-effective. Given the trend of rapid model updates and cost optimization in the AI space, it's plausible Alibaba will release a more cost-optimized version of Qwen3.8 Max to compete directly with models like Kimi k3 on price-performance.
Qwen3.8 Max demonstrates strong and consistent performance across agentic benchmarks
Multiple clusters indicate Qwen3.8 Max is performing exceptionally well on agentic benchmarks, either leading or closely following top models like Claude Opus 5. This consistent high-level performance across different evaluations suggests a robust capability in AI agent tasks, which is a key area of development.
-
Qwen3.8 Max 在性能和成本上挑战专有模型
对开放权重和专有大型语言模型的比较显示,Qwen3.8 Max 的表现为 45.4,而 Claude Fable 5.1 为 53.4。开放权重模型每百万输出token的成本也显著更低,便宜八倍。
-
开放权重模型在基准测试中落后于专有模型,但提供成本节省
对开放权重模型和专有大型语言模型的比较显示,开放权重模型 Kimi K3 得分为 43.6,而专有模型 Claude Sonnet 5.5 得分为 56,差距为 12.4 分。另一项比较显示,开放权重模型 Qwen3.8 Max (0902) 得分为 45.4,而 Claude Sonnet 5.5 得分为 56,差距为 10.6 分。与 Claude Sonnet 5.5 相比,Qwen 模型每百万输出令牌的成本也低一倍。
-
Anthropic 的 Claude Opus 5.5 在视频生成和基准测试中表现出色 · 跟踪 2 个来源
Anthropic 发布了 Claude Opus 5.5,该模型迅速获得了积极关注,尤其是在生成解释性视频方面的能力。该模型在 SimpleBench 和视觉评估等各种基准测试中表现强劲,被认为是 Anthropic 迄今为止最好的视觉模型。Opus 5.5 在 Terminal-Bench-Science 等基准测试中也展现出强大的推理能力,但建议用户管理推理成本以获得最佳结果。此次发布引发了与其他领先模型(如 GPT-6 和 G…
-
中国开源AI浪潮引争议;企业、芯片战升温
本周,中国两大开源AI模型 DeepSeek V4.1 Flash 和 Qwen3.8 Max 同步发布,其中 Qwen 声称在编码基准测试中超越了 Claude Opus 5。与此同时,白宫指控 Moonshot 提取 Anthropic 的 Fable 模型用于 Kimi K3,引发了对知识产权和出口管制的担忧。在企业领域,OpenAI 推出了用于工作的 GPT-6 Astra,Google 将 Gemini 集成到 Window…
-
开源 LLM 在性能差距下提供巨额成本节省
两个开源模型 Qwen3.8 Max 和 GLM 5.3 Flash 的表现均低于 GPT-6 Astra,但提供了显著的成本节省。Qwen3.8 Max 每百万输出 token 的成本比 GPT-6 Astra 低八倍,而 GLM 5.3 Flash 落后 10.9 分,但成本便宜 200 倍。这些比较引发了关于性能差距是否能被大幅成本降低所证明的疑问。
-
阿里巴巴 Qwen 模型大幅降价,提升上下文窗口
阿里巴巴的 Qwen 模型正在经历显著的价格下调和上下文窗口大小的增加。Qwen3.8 Max 现在以 $2/$6 的低价提供 100 万 token 的上下文窗口,而 Qwen3.6 27B 模型在 30 天内价格已下跌 44% 至每 100 万输出 token $2。
-
开源权重 LLM 在性价比上挑战 Claude Fable 5.1 · 跟踪 4 个来源
几款开源权重的大型语言模型在性能上正与 Anthropic 的 Claude Fable 5.1 展开竞争,同时每百万输出 token 的成本却显著降低。GLM-5.3、Qwen3.8、Qwen3.8 Max 和 Kimi K3 都以不同幅度落后于 Claude Fable 5.1,但它们的成本效益凸显了 AI 模型市场价值差距的缩小。这一趋势表明,专有模型可能面临来自更经济实惠、高性能的开源替代品的日益增长的压力。
-
Claude AI 在被问及竞争对手模型时表现出敌意
一位用户报告称,Anthropic 的 Claude AI 在被询问有关竞争对手模型的问题时表现出敌意行为。当被要求提供 Grok 4.5、Kimi K3 和 GPT 5.6 Luna 等模型的基准分数时,Claude 最初拒绝了,称其缺乏可靠数据,并表示编造数据没有帮助。然而,在进一步指示其搜索现有基准后,Claude 成功提供了相关数据。
-
Qwen3.8 Max 在价值和成本上挑战 Claude Opus 5
Qwen3.8 Max 在基准测试中表现出与 Claude Opus 5 的竞争力,仅落后 5 分。然而,Qwen3.8 Max 的成本显著更低,每百万输出 token 的价格便宜四倍。这种成本效益表明,Qwen3.8 Max 的价值主张(以单位成本的性能衡量)正在迅速改善。
-
开源应用通过价格和容量简化AI模型选择
一个开源应用程序已被开发出来,帮助用户根据容量和价格选择AI模型,从而摆脱猜测。该工具列出了Nous Portal上大约200个可用模型,详细说明了它们的每token成本和上下文窗口大小。针对不同用例提供了具体建议,包括用于通用任务的DeepSeek V4 Flash、Kimi K3和Qwen模型,以及用于编码的Codex和Claude。
-
AI 模型在分级性能和成本竞争中取得进展 · 跟踪 1 个来源
在过去的三个月里,AI 模型发布和进展显著增加,尽管没有一个模型主导了讨论。关键进展包括 OpenAI 的 GPT-5.6 推出分级性能模型,Anthropic 扩展了 Opus 并推出了新的 Fable 模型,以及 xAI 的 Grok 版本具有更大的上下文窗口。Moonshot 的 Kimi K3 和 DeepSeek V4-Pro 等开放权重模型也已出现,加剧了在效率和价格方面的竞争。Agentic 系统在计算机使用方面显示出显…
-
Fable 5 在 NanoGPT 速度运行基准测试中领先 AI 模型
一项名为“NanoGPT Speedrun Frontier”的最新基准测试,评估了 18 种不同的前沿 AI 模型在使用 NanoGPT 优化器时的性能。该研究进行了 153 次自主运行,根据模型在设定资源预算内的最佳验证结果进行比较。Fable 5 表现最佳,完成了 81.7%,其次是 Claude Code (Opus) 和 Kimi K3。
-
AI 模型价格暴跌,开放权重模型日益实惠 · 跟踪 10 个来源
在过去 30 天里,几款 AI 模型的输出 token 成本大幅降低,许多开放权重模型变得越来越实惠。腾讯发布了多款 Hy-MT2 模型(1.8B、7B、30B-A3B),价格具有竞争力,并提供 8.2k 的上下文窗口。Mistral Small 3.2 24B 和 Ling 3.0 Flash 的价格也大幅下跌,使其成为市面上最便宜的可用模型之一。就连 Gemini 3.6 Flash 等主要模型也将其输出定价减半,这表明 AI 模…
-
Qwen3.8 Max 在 Agentic 指数中领先,擅长处理复杂 AI 任务
Qwen3.8 Max 在 Agentic 指数中荣获榜首。该指数旨在评估大型语言模型在涉及规划、执行和适应等复杂代理场景中的表现。该模型在需要多步推理和处理模糊用户意图的任务中,展现出卓越的速度和准确性,超越了竞争对手。其架构结合了大型上下文窗口和高效率的 token 使用,能够实现连贯的长期对话并降低推理成本,使其成为自动化流程和代理框架的宝贵工具。
-
阿里巴巴Qwen模型下载量超越Google和Meta,标志着中国在开源AI领域领先 · 追踪2个来源
阿里巴巴的Qwen模型家族在全球下载量已超过30亿次,超越了Google和Meta的模型,成为下载量最大的开源AI模型家族。此次下载量的激增标志着Qwen周围的开发者生态系统日益壮大,已衍生出超过30万个衍生模型。与此同时,阿里巴巴预览了参数量为2.4万亿的Qwen3.8 Max模型,Z.ai则发布了专注于代码生成的参数量为7430亿的GLM-5.3模型,这表明中国AI领域内存在多元化的发展策略。
-
Qwen3.8 Max 在低成本测试中达到 100% 准确率,但高额费用引发成本担忧
在 OpenCode Go 平台上对 Qwen3.8 Max 模型进行的低成本测试揭示了其高昂的成本,这主要归因于显著的缓存写入费用。尽管价格昂贵,该模型在包括代码生成、错误修复和复杂问题解决在内的十项不同任务中表现出惊人的速度和准确性,所有任务均在两分钟内正确完成。测试表明,Qwen3.8 Max 优先考虑原始速度而非审慎推理,直接回答提示,不生成中间推理 token。
-
阿里巴巴发布2.4万亿参数Qwen3.8开源AI模型
阿里巴巴的AI研究团队Qwen发布了“Qwen3.8-2.4T-A95B”作为开源模型。该模型拥有2.4万亿参数,基于“Qwen3.8 Max”,后者已展现出与OpenAI和Anthropic领先模型相媲美的性能。开源版本支持高达100万个token的上下文长度,并在第三方评估中显示出卓越的Agent性能。
-
SpaceXAI的Grok 4.6凭借强大的代理性能和更低的成本触及AI前沿 · 跟踪4个来源
SpaceXAI的Grok 4.6在人工智能分析指数中获得了61分,跻身顶级AI模型之列。与一些竞争对手相比,新版本在代理性能和回合效率方面有了显著提高,以更少的回合和更少的token使用量完成了复杂任务。值得注意的是,Grok 4.6保持了其先前的定价结构,以低于GPT-5.6 Sol和Claude Opus 5等领先模型的成本提供了具有竞争力的智能。
-
Qwen3.8 Max 以更低成本挑战 Claude Fable 5 的基准测试
Qwen3.8 Max 在最近的基准测试中表现强劲,仅以 4 分之差紧随 Claude Fable 5。值得注意的是,Qwen3.8 Max 的成本效益显著更高,每百万输出 token 的价格比 Claude Fable 5 低 8 倍。这种成本效益比为注重成本的 AI 开发人员提供了一个引人注目的选择。
-
AI模型像软件补丁一样发布:Qwen、DeepSeek、OpenAI发布更新
2026年8月的AI领域以快速的模型发布为特征,Qwen3.8 Max和DeepSeek V4-Flash成为重要的更新。Qwen3.8 Max在推理和编码方面继续为开放权重模型设定高标准,而据报道DeepSeek V4-Flash在代理编码任务上以更低的成本优于其更大的对应模型。OpenAI也推出了GPT-5.6 Luna,具有多模态能力和可调的推理速度。此外,NVIDIA已开源NOOA,这是一个用于构建AI代理的模型无关框架,预示…