PulseAugur
实时 23:30:15

Krea 2 OSS Turbo 模型通过 FP8 量化进行优化,适用于消费级 GPU

一位社区贡献者通过将 Krea 2 OSS (Turbo) 模型的权重量化为 FP8 格式,对其进行了优化。此过程将模型大小从 24.76 GiB 大幅减小到 12.01 GiB,使其更容易在拥有 16GB 和 24GB GPU 的消费级硬件上运行。量化选择性地针对二维权重矩阵,同时为敏感层和向量保留更高的精度,旨在维持输出质量。 AI

影响 降低了 Krea 2 OSS (Turbo) 的 VRAM 需求,使其能在更广泛的消费级 GPU 上使用。

排序理由 这是对现有开源模型的社区优化,并非来自前沿实验室的发布。

在 Hugging Face Trending Models 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Krea 2 OSS Turbo 模型通过 FP8 量化进行优化,适用于消费级 GPU

报道来源 [1]

  1. Hugging Face Trending Models TIER_1 Deutsch(DE) · AlperKTS ·

    AlperKTS/Krea2_FP8

    text-to-image · 0 downloads · 49 likes