Évaluation de la génération d'images : FID, score CLIP et préférence humaine
Comment savoir si votre modèle de génération d’images s’améliore ? La comparaison pixel par pixel n’a aucun sens : deux images différentes de haute qualité d’un chat sont également valables. L'évaluation des images nécessite des mesures qui capturent ce qui intéresse les humains : le réalisme, la diversité et la correspondance de l'image avec l'invite textuelle. Cette leçon couvre les trois mesures dominantes et pourquoi aucune d’entre elles n’est suffisante à elle seule.