LoRA y QLoRA: matemáticas, selección de rangos y práctica
LoRA es la técnica que democratizó el ajuste de LLM. Antes, ajustar un modelo 7B requería ~112 GB de memoria GPU: 14 A100. Con QLoRA, el mismo trabajo cabe en una única GPU de consumo de 24 GB. Esta lección explica el truco matemático que hace esto posible, cómo elegir el hiperparámetro clave (rango) y cómo ejecutarlo en la práctica.