一款名为Soup的开源工具已发布,它可以在显存仅为4GB的消费级GPU上对大型语言模型进行微调。这是通过一种称为“层流式加载”(layer streaming)的技术实现的,该技术一次仅将模型所需的必要部分加载到显存中。开发人员使用配备4GB显存的GeForce RTX 3050笔记本GPU成功微调了Meta的Llama 3.1 8B Instruct模型,这表明复杂的AI模型训练正变得越来越普及。 AI
影响 降低了LLM微调的门槛,使得在消费级硬件上进行高级AI模型定制成为可能。
排序理由 发布了一款降低LLM微调硬件门槛的工具。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →