Qwen 3.8 Flash Next 大型语言模型已成功优化,可在内存为 12GB 的中端安卓手机上运行。这项成就,在对密集部分进行低量化的情况下,以每秒 3.5 个 token 的速度运行,证明了在消费级移动设备上部署先进 AI 模型的可行性。开发者强调,这种设置在价格在 400 美元到 500 美元之间的手机上是可能的。 AI
影响 展示了在消费级移动硬件上运行先进 LLM 的能力日益增强,可能拓宽其可及性和用例。
排序理由 该条目描述了在消费级设备上对现有 LLM 进行优化和本地部署,而不是发布新模型或重大的研究突破。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →