Una configuración con una GPU pequeña
Tienes una VRAM limitada y necesitas adaptar un modelo de lenguaje grande sin cargar todos los pesos con precisión completa.
QLoRA suele hacer posible el experimento al mantener el modelo base cuantizado mientras entrenas un adaptador de bajo rango.
lora ai frente a stable diffusion