Evaluación de la generación de imágenes: FID, puntuación CLIP y preferencia humana
¿Cómo saber si su modelo de generación de imágenes está mejorando? La comparación píxel por píxel no tiene sentido: dos imágenes diferentes de alta calidad de un gato son igualmente válidas. La evaluación de imágenes requiere métricas que capturen lo que les importa a los humanos: realismo, diversidad y qué tan bien la imagen coincide con el texto. Esta lección cubre las tres métricas dominantes y por qué ninguna de ellas por sí sola es suficiente.