PulseAugur
实时 11:48:31
实体 4GB GPU

4GB GPU

PulseAugur coverage of 4GB GPU — every cluster mentioning 4GB GPU across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_178662 ·

    AirLLM 通过逐层推理使 70B 模型在 4GB GPU 上运行 · 跟踪 8 个来源

    开源项目 AirLLM 已获得显著关注,在 GitHub 上获得了超过 27,000 颗星。其核心创新在于允许大型语言模型(特别是 700 亿参数模型)在单块 4GB GPU 上运行。这是通过一种逐层推理技术实现的,该技术仅将当前活动的层加载到 GPU 内存中,其余部分则驻留在磁盘上。虽然这使得在消费级硬件上运行大型模型成为可能,但其推理速度与传统方法相比会显著变慢。

  2. RESEARCH · CL_148763 ·

    现在可以在消费级笔记本电脑和 PC 上运行巨大的 AI 模型

    新的发展使得在消费级硬件上运行大型 AI 模型成为可能,显著降低了本地 AI 开发的门槛。AirLLM 等项目能够让参数量为 700 亿的模型在仅需 4GB VRAM 的 GPU 上运行,而 Colibri 则允许参数量为 7440 亿的模型通过从磁盘流式传输专家来在拥有 25GB RAM 的笔记本电脑上运行。这些进展,以及 wigolo 用于本地网络研究和 code-review-graph 用于上下文管理的工具,使开发人员能够拥有…