PulseAugur
实时 05:06:37
English(EN) I spent 8 hours debugging why ComfyUI was broken on my Quadro RTX 6000. Found 3 independent bugs. Here's what I learned.

Turing GPU上的ComfyUI Bug详解:FP16溢出,CUDA分配崩溃

一位Reddit用户详细介绍了影响Turing架构GPU(特别是Quadro RTX 6000)上ComfyUI的三个bug。发现的主要问题是,当输入值超过约44时,PyTorch的`torch.mm()`函数中出现FP16溢出,导致出现无穷大值和黑色图像输出。此bug存在于PyTorch 2.12.0+cu126中,可以通过使用`.bfloat16()`而不是`.half()`来缓解。此外,Turing GPU在启动时可能会遇到`cudaMallocAsync != native`崩溃,通过设置`PYTORCH_CUDA_ALLOC_CONF`环境变量可以解决。用户还指出,持续的问题可能表明GPU显存存在硬件缺陷。 AI

影响 解决了影响特定硬件上AI图像生成工作流的特定软件bug。

排序理由 用户报告的针对特定工具和硬件的软件问题调试。

在 r/StableDiffusion 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Turing GPU上的ComfyUI Bug详解:FP16溢出,CUDA分配崩溃

报道来源 [1]

  1. r/StableDiffusion TIER_2 English(EN) · /u/rtsitola ·

    我花了8小时调试ComfyUI在我的Quadro RTX 6000上为何会出问题。发现了3个独立bug。我学到了什么。

    <!-- SC_OFF --><div class="md"><p>If you're running ComfyUI on a Turing GPU (Quadro RTX 4000/5000/6000/8000) and getting black images or NaN errors, this post is for you.</p> <p>## The Symptoms</p> <p>- ComfyUI output: pure black images (10 KB PNG instead of 1.5 MB)</p> <p>- Cons…