一款名为 Ox Alpha 的新模型已发布为 GLM-5.3-Flash,能够每天处理 100 万亿个 token。值得注意的是,据报道,这种巨大的处理能力是使用中国芯片实现的,其硬件效率和每个 token 的成本可与 Nvidia GPU 相媲美。这一发展挑战了现有硬件供应商的主导地位,并预示着大规模人工智能计算格局的转变。 AI
影响 挑战 Nvidia 的 CUDA 生态系统,并预示着人工智能计算基础设施向中国硬件转移。
排序理由 该集群宣布了一个新模型 (GLM-5.3-Flash) 及其功能,重点关注底层基础设施 (中国芯片) 及其竞争影响。
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →