一项名为 Maple-Preview 的新演示展示了一个 200 亿参数的专家混合(MoE)模型,能够在 iPhone 上以每秒 120 个 token 的速度运行。这一进展凸显了大型语言模型日益提高的效率和设备端能力。 AI
影响 展示了设备端 AI 处理方面的重大进展,有可能支持更强大的移动应用程序。
排序理由 演示了模型在消费级硬件上运行,而非前沿实验室发布的新模型。
在 Hacker News — AI stories ≥50 points 阅读 →
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →