Ajuste: enseñar nuevos trucos a un LLM sin volver a capacitarse por completo

GPT-4 puede hacer mucho, pero no conoce sus flujos de trabajo internos. Es posible que BERT no conozca la jerga médica de su clínica. El ajuste fino adapta un modelo previamente entrenado a una tarea o dominio. El ajuste completo es costoso: el LLaMA-7B necesita varios A100. LoRA es elegante: congela ~99% de los pesos y entrena solo dos matrices pequeñas. La calidad se aproxima al pleno comercio justo; la memoria suele ser entre 10 y 50 veces más pequeña.

Full content is available with a subscription.
Get full access to all courses on the platform for one year with a single payment.
Unlike other platforms that charge per course, here you get everything for one price, and after one year of use there will be no automatic charge for the following year.