本周,两家主要的人工智能实验室 Z.ai 和阿里巴巴发布了新的前沿模型,显著降低了访问高性能人工智能功能的成本。Z.ai 的 GLM-5.3-Flash 和阿里巴巴的 Qwen3.8-Flash-Next 都提供了与更昂贵模型相当的性能,但价格却低得多,输入 token 每百万成本约为 0.15 美元。这些发布利用了先进的架构设计,如混合专家模型(Mixture-of-Experts)和稀疏注意力机制,以实现更高的效率和更低的部署成本,其中 Z.ai 特别强调了它们可以在中国生产的 AI 芯片上运行的能力。 AI
影响 加速了高效 AI 模型的采用,降低了 AI 应用的运营成本。
排序理由 该集群报道了 Z.ai 和阿里巴巴的新模型发布,这些模型被描述为具有显著成本降低的前沿 AI 模型。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →