Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
Large diffusion transformers can create stunning images (or even videos, audio snippets, and now text), but loading a modern text-to-image model in BF16 precision often requires 20-30 GB of VRAM,…