研究人员开发了一种名为SVDtrunc的新颖方法,用于压缩Diffusion Transformers (DiTs),这是一种流行的文本到图像生成架构。与可能导致性能下降的先前方法不同,SVDtrunc采用了一个两步过程,包括块级秩分配和截断奇异值分解。该方法实现了显著的参数缩减,在68%的压缩率下仍能保持接近完整的性能,并在57%的压缩率下保持竞争力。该技术在多个基准测试中展示了卓越的结果,优于现有方法,并与其他效率改进(如扩散步数减少)相辅相成。 AI
影响 使得大规模生成模型能够更高效地部署,可能降低计算成本并提高可访问性。
排序理由 该集群包含一篇详细介绍新模型压缩方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →