PulseAugur
实时 12:45:51

FreeToken 系统使大型 MoE 模型能在个人设备上运行

一个名为 FreeToken 的新服务系统已被开发出来,以支持大型专家混合(MoE)模型在个人设备上的高效运行。该系统动态适应异构本地硬件,优化计算和模型状态,以持续映射到可用资源。FreeToken 支持广泛的 MoE 模型和代理工作负载,允许在消费级硬件上部署明显更大的模型,例如在单个工作站 GPU 上运行 753B 模型。 AI

影响 使大型 AI 模型能在个人硬件上运行,从而普及先进的 AI 功能。

排序理由 发布详细介绍新服务系统的论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 Hugging Face Daily Papers 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

FreeToken 系统使大型 MoE 模型能在个人设备上运行

报道来源 [1]

  1. Hugging Face Daily Papers TIER_1 English(EN) ·

    FreeToken:高效的边缘原生 MoE 服务与带宽自适应执行

    FreeToken is an edge-native Mixture-of-Experts serving system that dynamically maps computation and model state onto heterogeneous local hardware to run large open-weight models on personal machines.