一位开发者为 AMD 的 RDNA4 显卡创建了一个优化的 SageAttention 构建,专门针对 Windows 上的 RX 9070 和 9070 XT。这个自定义构建使用了用 HIP 编写的 fp8 attention kernel,与现有的移植版本和 PyTorch 的 Scaled Dot-Product Attention (SDPA) 相比,实现了更快的性能。虽然 kernel 级别的提升很显著,但对 ComfyUI 采样步骤的整体影响是 5-14% 的改进,作者在 GitHub 仓库中详细介绍了技术历程和注意事项。 AI
影响 提高运行 ComfyUI 的特定 AMD GPU 用户的性能,可能加快图像生成工作流程。
排序理由 针对特定硬件/软件组合(ComfyUI 上的 RDNA4 GPU)优化特定组件(SageAttention)。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →