Ein kleines GPU-Setup
Du hast nur begrenzten VRAM und musst ein großes Sprachmodell anpassen, ohne alle Gewichte in voller Präzision zu laden.
QLoRA macht das Experiment in der Regel möglich, indem das Basismodell quantisiert bleibt, während ein Adapter mit niedrigem Rang trainiert wird.
LoRA AI vs. Stable Diffusion