一种名为 SVDQuant 的新量化方法,以及原生 INT8/W4A4 支持,已在 ComfyUI 界面内的 Krea 2 模型上开发完成。此优化显著加快了图像生成速度,与标准的 FP8 版本相比,性能提升高达 2 倍,模型大小减小约三分之一。该方法旨在兼容各种 NVIDIA GPU,包括不支持 FP8 张量核心的旧型号。 AI
影响 提升了消费级硬件上图像生成模型的性能和可访问性。
排序理由 这是针对现有 AI 模型和界面的社区开发优化,并非来自前沿实验室的发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →