一位开发者成功地在 8 美元的 ESP32-S3 微控制器上运行了一个拥有 2890 万参数的语言模型,实现了每秒约 9 个 token 的速度,无需云端依赖。这项边缘 AI 的重大进展利用了 Google 的逐层嵌入技术,允许模型的大部分参数驻留在慢速闪存中,同时将核心处理组件保留在芯片有限的 SRAM 中。该模型在 TinyStories 数据集上进行训练,能够生成简短、连贯的叙事,展示了低成本、离线生成式 AI 应用的新能力。 AI
影响 使复杂的人工智能能力能够在成本极低、功耗极高的边缘设备上实现,为离线智能传感器和嵌入式系统开辟了新的可能性。
排序理由 该项目展示了在商品硬件上运行大型 LLM,这是边缘 AI 的一项重大工具化进展。
在 Mastodon — fosstodon.org 阅读 →
- esp32-ai
- slvDev
- Andrej Karpathy
- ESP32-S3
- Gemma
- llama2.c
- Microsoft Research
- Ronen Eldan
- TinyStories
- Yuanzhi Li
- GitHub
- Hacker News
- Per-Layer Embeddings
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →