Ajuste: enseñar nuevos trucos a un LLM sin volver a capacitarse por completo
GPT-4 puede hacer mucho, pero no conoce sus flujos de trabajo internos. Es posible que BERT no conozca la jerga médica de su clínica. El ajuste fino adapta un modelo previamente entrenado a una tarea o dominio. El ajuste completo es costoso: el LLaMA-7B necesita varios A100. LoRA es elegante: congela ~99% de los pesos y entrena solo dos matrices pequeñas. La calidad se aproxima al pleno comercio justo; la memoria suele ser entre 10 y 50 veces más pequeña.