Nunchaku Lite en Diffusers: inferencia 4-bit para modelos de difusión
Diffusers ahora soporta checkpoints al estilo Nunchaku con ejecución 4-bit (W4A4) directamente desde from_pretrained(), sin motores de inferencia separados ni compilación local. Esto permite ahorrar memoria y ganar velocidad en GPUs modernas.