LoRA et QLoRA : les mathématiques, la sélection des classements et la pratique
LoRA est la technique qui a démocratisé le réglage fin du LLM. Avant cela, le réglage fin d’un modèle 7B nécessitait environ 112 Go de mémoire GPU – 14 A100. Avec QLoRA, le même travail peut être effectué sur un seul GPU grand public de 24 Go. Cette leçon explique l'astuce mathématique qui rend cela possible, comment choisir l'hyperparamètre clé (rang) et comment l'exécuter en pratique.