一位社区贡献者通过将 Krea 2 OSS (Turbo) 模型的权重量化为 FP8 格式,对其进行了优化。此过程将模型大小从 24.76 GiB 大幅减小到 12.01 GiB,使其更容易在拥有 16GB 和 24GB GPU 的消费级硬件上运行。量化选择性地针对二维权重矩阵,同时为敏感层和向量保留更高的精度,旨在维持输出质量。 AI
影响 降低了 Krea 2 OSS (Turbo) 的 VRAM 需求,使其能在更广泛的消费级 GPU 上使用。
排序理由 这是对现有开源模型的社区优化,并非来自前沿实验室的发布。
在 Hugging Face Trending Models 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →